指南
AI 音乐提示词:弱 vs 强,对比
同一个想法用两种写法并排对比——把“情绪”换成明确的节奏、乐器和人声选择,输出会怎么变。

一句话
强力 AI 音乐提示词的结构
每个有效的提示词都由少量配方构成。你不必每次都把它们全用上,但指明得越多,结果就越接近你脑海里的声音。
- 流派——地基:lo-fi、电影感、流行、EDM、嘻哈、氛围、摇滚、爵士。
- 情绪——感觉:平静、宏大、忧郁、振奋、阴暗、梦幻、刚猛。
- 配器——你会听到什么:温暖的 Rhodes、808、华丽的弦乐、指弹吉他、模拟合成器。
- 速度与能量——慢而留白、中速律动、快速推进,或直接给出 BPM。
- 人声与主题——用于歌曲:人声风格、语言,以及歌曲在讲什么(或贴上你的歌词)。
- 结构与用途——“build to a drop”(铺垫到 drop),“可循环”,或“烹饪视频的背景音乐”。
一个填空式提示词公式
当你不知道从哪下手,用这个模板,把方括号替换掉:“[情绪] 的 [流派],包含 [乐器1]、[乐器2] 和 [乐器3],[速度/能量],[用途 / 结构]。[做歌曲则加:人声风格 + 主题。]”
例如:“梦幻的 synthwave,带模拟 pad、闸门鼓和明亮主音,中速、怀旧,铺垫到开阔的大副歌。男声,人群像希望,主题是夜里开车回家。”模型现在有了流派、情绪、三种乐器、能量、结构提示,以及清晰的人声简报——足够它选定一个方向。
按场景分类的可复制提示词示例
这些是你可以直接粘贴再微调的起点。每条都按上面的公式写,覆盖常见创作需求。
- Lo-fi 学习节拍:“放松的 lo-fi 嘻哈,温暖的 Rhodes 和弦、松弛摇摆的鼓、黑胶噼啪与雨声,慢而惬意,可循环用于学习。”
- 电影预告片:“史诗级 cinematic 铺垫,低音弦与 braams、太鼓,张力渐强,结尾给出巨大一击,戏剧化且英雄气。”
- 高能流行(带人声):“明亮的现代流行,鼓点有冲劲,拨弦合成器与贝斯,活力而快乐,抓耳的女声,主题是夏日恋曲,大合唱能一起唱。”
- 播客片头:“自信的独立电子片头 sting,干净电吉他与温暖合成器,中速、友好,15–20 秒,结尾干净收尾留对白空间。”
- 游戏循环:“氛围感 ambient 游戏音乐,柔和 pad、远处的钟声与细微脉冲,平静而神秘,为探索场景无缝循环。”
- 广告底床:“积极向上的企业流行底床,拍手、拨弦合成器与稳定的 four-on-the-floor,乐观干净,为旁白留空间。”
弱 vs 强提示词:改写前后
多数人能做的最大升级,就是加“具体”。下面是同一意图的两种写法,先弱后强。
| 用例 | 弱提示词 | 强提示词 |
|---|---|---|
| 学习节拍 | make a chill beat | 放松的 lo-fi,温暖 Rhodes、松弛摇摆的鼓、黑胶噼啪,慢而惬意,可循环 |
| 预告片配乐 | epic music | 史诗 cinematic 铺垫,低音弦、太鼓,渐进到巨大一击,戏剧化、英雄气 |
| 流行歌曲 | a happy song with vocals | 明亮流行,鼓点有冲劲与拨弦合成器,快乐,女声唱夏天主题,大副歌 |
| 游戏音乐 | background music for a game | 平静的 ambient pad、远处钟声、细微脉冲,神秘,为探索场景无缝循环 |
毁掉 AI 音乐提示词的常见错误
大多数让人失望的结果,都来自几条本可避免的习惯。
- 过于含糊——“好听的音乐”让模型没有任何可抓的方向。
- 堆叠自相矛盾——“平静又激烈的爵士EDM”把模型拽向四个方向。
- 忘了人声需求——你想要歌曲就直说,并把人声描述清楚。
- 过度塞料——十种乐器加五种情绪只会把混音搅浑;只选最重要的三个。
- 想克隆某位实名艺人来冒充对方——别说伦理问题,就算撇开不谈,效果也更差、更含糊,不如直接描述你真正想要的声音。
进阶提示词:参考风格、结构与歌词
基础跑通后,你就能更精细地掌舵。用风格而不是人名作参考——“90s boom-bap”“Berlin techno”“spaghetti-western”——唤起声音气质而不去模仿某个具体艺人。再加上结构语言,比如“intro,两段主歌,一个大副歌,一个桥段,最后再来一个副歌”,来塑造编排。
做歌曲时,你可以只给主题让模型写歌词,或粘贴你自己的词让它来演唱。自己写的话,把段落标清楚(Verse、Chorus、Bridge),这样旋律会跟着结构走。让句子好唱——短而有律动的短语胜过密不透风的大段文字。
迭代:提示词只是起点
AI 音乐生成是概率性的,同一个提示词会产出不同的版本。这是优点。多生成几版,留最强的,然后每次只改一处——换一种乐器、提高能量、收紧结构——再生成。两三轮小改动通常就能把“不错”打磨成你想要的那条音轨。快到位时,导出分轨,用你自己的软件完成制作。
AI 音乐提示词:弱 vs 强,对比 — 常见问题
什么样的 AI 音乐提示词算好?
具体。说出流派和情绪,再点两三样乐器,定下能量或速度;做歌曲时,描述人声和主题。具体的提示词给模型明确方向;含糊其辞只会让它瞎猜。
AI 音乐提示词该有多长?
够覆盖流派、情绪、配器和能量就行——通常一两句话。更长也没问题,只要每个细节都在指路;但把十种乐器和五种情绪全塞进去会搅浑结果。追求清晰,不要堆满。
写提示词需要懂乐理吗?
不需要。直接的形容词就管用:“温暖”“有推动力”“空间感”“怀旧”。懂点术语(速度、调性、BPM、主歌/副歌)会更精确,但不是必须——把感觉和你能想象到的乐器说清楚就好。
要不要写上 BPM 或速度?
有目标就写——“90 BPM”或“快速而有推进感”都很有帮助。速度强烈影响手感,即便是粗略提示(慢速、中速、欢快)也能改善结果。如果你不指定,模型会选一个符合该流派的速度。
能在提示词里点名某位艺人吗?
说风格,不说人——用“90s boom-bap”或“dreamy bedroom-pop”,别写真实艺人名。这样产出更好、更可控,也能避免为了欺骗听众去模仿真实表演者——多数工具都禁止,而且还可能引发法律问题。
怎么用提示词得到人声和歌词?
说清楚你要带人声的歌曲,描述人声的风格和语言,然后要么给出主题让 AI 写词,要么粘贴你自己的歌词。标注段落(Verse、Chorus)有助于旋律按你设想的结构走。
为什么同一个提示词每次都会蹦出不同的歌曲?
生成是有创造性且带随机性的,每次都是一次全新的解读。把这点变成优势:多生成几版,留最好的一版,然后优化提示词再生成,逐步收敛到你想要的结果。
怎么写适合做背景音乐的提示词?
把使用场景写上,并要求给叙述留空间:“欢快的企业背景床,拨弦合成器和拍手,乐观,给旁白留空,可循环”。告诉模型这是背景床,会避免它挤占你的配音或视频。
一个提示词不奏效时,最快的改进方法是什么?
每次只改一个变量。太吵就减掉乐器;太平就把能量拉高;感觉不对就换个情绪词。小而单点的修改配合再生成,远比从头重写整条提示词有效。
来源与延伸阅读
继续看
更多博客内容
近期关于行业、创作技法和授权问题的文章。
探索





