Stable Audio 3 是由 Stability AI 于 2026 年 5 月发布的开放权重 AI 音频生成模型家族。该工具支持根据文本提示词生成音乐、音效和氛围音,并提供音频编辑与局部重生成功能

image.png

核心功能

  • 文本生成音频:通过描述风格、乐器、情绪和速度等文字提示,将其转化为完整的音频片段

  • 音频转音频:上传现有音频并描述期望的改写方向(如切换风格、替换乐器),获得一个全新版本

  • 局部重生成:选中音频中的特定区域,只重新生成该部分,用于修正错音、去除不想要的声音或延长循环

  • 音效生成:快速生成短音效,如脚步声、汽车声、UI 点击音或环境雨声

  • 时长灵活:音频时长可从几秒到最长 6 分 20 秒(Medium 模型),适合从短音效到长氛围背景的多种需求

  • 多模型选择:在 Medium(完整歌曲,最长 6 分钟)、Small Music(循环和短曲)和 Small SFX(音效,生成更快)之间切换

适用场景

该工具适用于多种创作场景

  • 内容创作者:为 YouTube、TikTok 等视频生成匹配的背景音乐。

  • 游戏开发者:使用 Small SFX 模型快速制作 UI 音效、环境音和战斗音效。

  • 播客主:生成片头片尾音乐,或打磨背景音。

  • 音乐人与制作人:快速将想法变成音频草图,以便导入专业软件继续创作。

  • 主播与应用开发者:为直播、专注列表或冥想 App 生成长氛围背景音。

使用方式与注意事项

使用门槛极低,无需注册、无需安装、无需 GPU,直接在浏览器中即可免费使用。音频以 44.1 kHz 立体声 WAV 格式 输出,支持直接下载

关于商业使用,Stability AI 表示,其输出可在 Stability AI Community License 下分发和商业化,超过收入门槛的组织需使用 Enterprise License。建议在正式商用前确认最新的官方条款。

©️版权声明:若无特殊声明,本站所有文章版权均归AI工具集原创和所有,未经许可,任何个人、媒体、网站、团体不得转载、抄袭或以其他方式复制发表本站内容,或在非我站所属的服务器上建立镜像。否则,我站将依法保留追究相关法律责任的权利。

类似网站

暂无评论