产品信息
什么是 Stable audio open?
Stable Audio Open 允许任何人从简单的文本提示中生成高达47秒的高质量音频数据。它的专业训练使其非常适合创建鼓节拍,乐器即兴,环境声音,Foley录音和其他音频样本,用于音乐制作和声音设计。
此开源发布的一个关键好处是,用户可以在自己的自定义音频数据上微调模型。例如,鼓手可以对自己的鼓记录的样本进行微调以产生新的节奏。
它与稳定音频有何不同
稳定的音频产品可生产高质量的完整曲目,具有连贯的音乐结构长达三分钟,以及高级功能,例如音频到审计的生成和连贯的多部分音乐作品。
另一方面,Stable Audio Open 专门研究音频样本,声音效果和生产元素。虽然它可以产生简短的音乐剪辑,但并未针对完整歌曲,旋律或人声进行优化。这种开放模型可瞥见用于声音设计的生成AI,同时与创意社区一起优先考虑负责任的发展。
新车型接受了Freesound和Free Music Archive的音频数据的培训。这使我们能够在尊重创建者权利的同时创建一个开放的音频模型。
如何使用 Stable audio open?
Stable Audio Open是一个开源的文本转音频模型,能根据文本提示生成长达47秒的高质量音频样本,主要用于音乐制作和声音设计。
Stable audio open 的核心功能
音效
Stable audio open 的使用场景
- 创建鼓点
- 生成乐器即兴演奏
- 制作环境音效
- 录制拟音
- 为音乐制作和声音设计生成音频样本
- 鼓手基于自己的录音微调模型以生成新鼓点
Stable audio open 的常见问题
Stable Audio Open做什么的?
我如何使用Stable Audio Open?
Stable Audio Open有哪些核心功能?
Stable Audio Open有哪些应用场景?



















