
在现有音频内填充生成
把失败的段落重生一遍、又不动周围内容——这才是别的媒介里编辑的常态,而几乎没有音乐模型支持。
Stability AI
在已有音频里动刀,不只是凭空生成。
一句话
数据已核实 2026-08-10。 这个领域变化很快——在依赖它们前请再核对一遍。
几乎所有音乐模型都是“文生音频”函数:给提示词,吐新音频,和你已有素材毫无关系。Stable Audio 2.5 的重绘与续写打破了这个模式,实际意义很大。若一首作品中间的四小节不行,你可以只把这四小节重绘,周围一切不动——这才是其他媒介里的编辑常态。续写则能把你亲自演奏的八小节接着写下去,风格连贯。音效生成是它被低估的真长处——冲击、呼啸、质感和拟音是视频剪辑师的刚需,常要却难找。拿它当写歌工具不惊艳;拿它当带生成引擎的音频编辑工具,它是这个领域更有用的模型之一。
长处

把失败的段落重生一遍、又不动周围内容——这才是别的媒介里编辑的常态,而几乎没有音乐模型支持。

把你自己弹的若干小节交给它,拿回连贯的续写,让它成了现有素材的合作者,而不是老虎机。

冲击、呼啸和拟音是视频编辑的刚需,这里生成它们远比在素材库里搜快。
怎么比
Stable Audio 2.5 能生成器乐和音效,也能在你提供的音频里直接编辑——把片段中间的一段重绘,或把你已有的片段续写下去。这种编辑能力是它和大多数生成模型的分水岭。
与 MusicGenerate 对比
检索词用 stable audio 2.5、stable audio inpainting、stable audio sound effects。它的编辑能力是把它和其他开源模型区分开的关键。
在现有片段的中间重绘一段,同时保留其余部分。如果四小节不对劲,你只重绘这四小节,而不是整条音轨重来——这才是别的媒介里的编辑方式。
能。给它你演奏的八小节,它会产出同风格的连贯续写,让它成了现有素材的合作者,而不是老虎机。
这是它的真本事之一——冲击、呼啸、质感和拟音是视频剪辑师的刚需,这里生成它们远比在素材库里搜快。
需要在已有音频内编辑就用 2.5。要尽可能长的一段连续输出就用 3.0。
开源权重版可免费下载并在你自己的 GPU 上跑;托管版按订阅计费。科研与商用的许可不同,阅读你那一版随附的许可。
不能。它专注器乐和声音设计,所以我们把它当带生成引擎的音频编辑工具来评,而不是当歌曲模型。