Stable Audio

2026-03-24发布 180 0 0

支持文生音乐、音效和 Audio-to-Audio 变体,并按主体类型区分许可

所在地:
USA
语言:
en,zh
收录时间:
2026-03-24
Stable AudioStable Audio

Stable Audio 是 Stability AI 的音乐与声音生成服务,提供 Text-to-Audio 和 Audio-to-Audio。它既能生成音乐,也能制作环境声、音效和声景;当前页面写明最长可生成 6 分钟,并以 44.1kHz 立体声下载。

文字与音频两种起点

模式 输入 适合任务
Text-to-Audio 风格、乐器、情绪、速度、时长 从零生成配乐或音效
Audio-to-Audio 自有音频加文字描述 做风格变化和相近版本

上传音频只应用于自己拥有或已获授权的素材,不把商业歌曲作为“参考”规避许可。

提示词要写声音事件

背景音乐可描述类型、主要乐器、速度、情绪和结构;音效则应写清声源、空间、距离和时间变化。例如“木门在狭窄走廊缓慢打开,近距离摩擦声,末尾轻响”,比只写“恐怖音效”更可执行。

生成长音频先做短样

六分钟上限不意味着每次都应直接生成满时长。先用短片段确认音色、节奏和噪声,再生成较长版本;否则一次偏离会浪费更多额度。长内容还需检查重复、能量变化、循环接缝和结尾是否自然。

三类许可按使用者区分

  • Personal:用于个人和非商业项目。
  • Creator:个人创作者可用于商业项目和音乐发行。
  • Enterprise:中大型组织或自有基础设施部署需企业许可。

官方定价页特别说明,年收入超过 100 万美元且希望自部署模型的企业应联系授权团队。

套餐还限制上传量

除生成次数外,不同档位还区分每月可上传的音频分钟数。Audio-to-Audio 用户应按原始素材总时长估算,而不是只看生成次数;团队共享素材时还需确认账号权限和客户文件保留方式。

声音设计的交付方法

  1. 保存提示、随机参数、输入音频与生成日期。
  2. 对候选做降噪、淡入淡出和响度统一。
  3. 分别试听耳机、手机和目标播放环境。
  4. 把许可、模型版本和最终 WAV 与项目一起归档。

长音频验收:六分钟素材不能只听开头。至少检查中段是否出现突兀换拍、频谱塌陷或重复循环,结尾是否完整,并在目标设备上试听。作为游戏声景时还要另做循环点,保存无损原件、剪辑版和响度处理版,避免反复转码。

适合与不适合

Stable Audio 适合配乐草稿、游戏环境声、转场和长声景,也适合从自有录音派生变化。需要逐句歌词、稳定歌手角色或完整人声制作时,应搭配专门歌曲或语音工具;生成音频仍需混音、版权审查和场景测试。

数据统计

相关导航

暂无评论

none
暂无评论...