
Suno
文字生成完整歌曲,免费与付费计划商用边界清晰
Stable Audio 是 Stability AI 的音乐与声音生成服务,提供 Text-to-Audio 和 Audio-to-Audio。它既能生成音乐,也能制作环境声、音效和声景;当前页面写明最长可生成 6 分钟,并以 44.1kHz 立体声下载。
| 模式 | 输入 | 适合任务 |
|---|---|---|
| Text-to-Audio | 风格、乐器、情绪、速度、时长 | 从零生成配乐或音效 |
| Audio-to-Audio | 自有音频加文字描述 | 做风格变化和相近版本 |
上传音频只应用于自己拥有或已获授权的素材,不把商业歌曲作为“参考”规避许可。
背景音乐可描述类型、主要乐器、速度、情绪和结构;音效则应写清声源、空间、距离和时间变化。例如“木门在狭窄走廊缓慢打开,近距离摩擦声,末尾轻响”,比只写“恐怖音效”更可执行。
六分钟上限不意味着每次都应直接生成满时长。先用短片段确认音色、节奏和噪声,再生成较长版本;否则一次偏离会浪费更多额度。长内容还需检查重复、能量变化、循环接缝和结尾是否自然。
官方定价页特别说明,年收入超过 100 万美元且希望自部署模型的企业应联系授权团队。
除生成次数外,不同档位还区分每月可上传的音频分钟数。Audio-to-Audio 用户应按原始素材总时长估算,而不是只看生成次数;团队共享素材时还需确认账号权限和客户文件保留方式。
长音频验收:六分钟素材不能只听开头。至少检查中段是否出现突兀换拍、频谱塌陷或重复循环,结尾是否完整,并在目标设备上试听。作为游戏声景时还要另做循环点,保存无损原件、剪辑版和响度处理版,避免反复转码。
Stable Audio 适合配乐草稿、游戏环境声、转场和长声景,也适合从自有录音派生变化。需要逐句歌词、稳定歌手角色或完整人声制作时,应搭配专门歌曲或语音工具;生成音频仍需混音、版权审查和场景测试。
