Stability AI 发布 Stable Audio 3 Optimized 加速版
原标题:stabilityai/stable-audio-3-optimized
AI 摘要
Stability AI 发布了 Stable Audio 3 Optimized,这是一系列针对特定硬件加速优化的实验性检查点,基于潜在扩散模型,支持可变长度音频生成和编辑。模型在 H200 GPU 上生成音频不到 2 秒,在 MacBook Pro M4 上仅需几秒,并提供了 TFLite/LiteRT 优化 CPU 运行时。该模型使用 T5Gemma 进行文本条件处理,训练数据包含来自 AudioSparx 和 Freesound 的授权音频,并已过滤版权内容。
正文节选
--- language: - en library_name: stable-audio-3 license: other license_name: stable-audio-community license_link: LICENSE pipeline_tag: text-to-audio tags: - audio-generation - music - sound-effects - diffusion --- # Stable Audio 3 Optimized > **Note:** This repository contains experimental checkpoints optimised for acceleration on specific hardware. For standard checkpoints, please use [Stable Audio 3 Medium](https://huggingface.co/stabilityai/stable-audio-3-medium) instead. Please note: For