9月13日(当地时间),以 Stable Diffusion 等也广为人知的 Stability AI 发布了音频生成AI模型“Stable Audio”。可从文本提示生成音乐和声音。
Stable Audio
Stable Audio 已准备好轰鸣登场!现在就来试试这款用于音乐和声音生成的新AI产品!
使用 Stable Audio,只需文本提示和指定时长即可生成音乐和音效。采用音频模型的潜在扩散技术,以高品质 44.1 kHz 立体声生成音频。专业用户可以下载用于商业用途的音频,任何人都可以免费试用。
Stable Audio 试过了吗?
希望大家今年的音乐之秋能用 Stable Audio 尽情享受。https://t.co/YnQaPzFIhW pic.twitter.com/iUP2sRtIL8— Stability AI 日本官方 (@StabilityAI_JP) September 21, 2023
虽然已经存在一些由 AI 进行音乐生成的服务,但 Stable Audio 算是万能型的感觉吗。还能制作音效这点也不错。
AI 太厉害了
我也用免费版稍微试了一下
taiko solo, Dynamic, Flowing
太鼓独奏、动态、流动
明明是太鼓独奏,却混进了些有点不一样的声音呢
大概有六成符合想象,不过要输出符合预期的声音,似乎还需要一些提示词技巧
接下来试试偏音效的东西……(以 Suzanne 为意象)
Monkeys, squeals, jungle, environmental sounds
猴子、叫声、丛林、环境音
注意音量
像个傻乎乎的猴子叫声
……唉
那么这个呢
Monkey roar, piano solo, Flowing
猴子咆哮、钢琴独奏、流动
注意音量
对!就是这个!这才是音乐!
………
Stable Audio 的许可证
- Free:免费
(每月 20 首曲目,单曲最长 45 秒,仅可下载 MP3,非商用) - Professional:$11.99/月
(每月 500 首曲目,单曲最长 90 秒,可下载 MP3&WAV,支持商用) - Enterprise:请联系咨询

今后,像稍微做一下 BGM 或音效之类的需求,大概会逐渐成为 AI 生成的主流吧。希望能好好加以利用。
个人来说,如果有介于 Free 和 Pro 之间的方案就好了……
请务必来看看“Stable Audio”!
链接
Stable Audio – Generative AI for music & sound fx