MusicGenerate

教程

怎么写真有用的 AI 音乐提示词

如何写 AI 音乐提示词:每个好提示词都要点到的六个要素、可直接套用的模板,以及如何修正“差一点就对了”的结果。

作者 MusicGenerate 编辑团队
发布更新
8 分钟读完

一句话

一个好的 AI 音乐 prompt 要说清六件事:风格、以 BPM 表示的速度、调性或情绪、配器、人声类型,以及制作风格。把这六项都说全的 prompt 更接近你脑子里的声音;只堆“chill”或“epic”这类形容词的 prompt,给你的只是模型在这些词下见过的一切的平均值。

一个好用的 prompt 的六个要素

把 prompt 当成你给录音室乐手的任务单。含糊的任务单只会换来普通货;精确的任务单才能做出你脑海里的声音。下面这六个要素,最能真正起作用。

不必每次都写满六项,但你说得越细,模型需要猜的就越少。

  • 流派 / 风格——“boom-bap 嘻哈”“前卫浩室”“电影预告片”
  • 情绪 / 能量——“忧郁”“凯旋”“松弛”“紧张”
  • 速度——一个 BPM 数字(例如 90 BPM),或一种感觉(“慢速”“推进感强”)
  • 乐器——只点关键的几样:“爵士味钢琴、立式低音提琴、刷奏鼓”
  • 人声——性别、音色和歌词主题,或写“instrumental only”
  • 参考 / 用途——“电影预告片风格”“用于安静的学习视频”

可直接复制并改动的 prompt 模板

按用途分类的入门 prompt——细节按你口味改就行。
你想要…用这个 prompt 试试
一首 lo-fi 学习节拍85 BPM 的 chill lo-fi 嘻哈,温柔钢琴、轻柔鼓点、黑胶噼啪声和雨声氛围纹理——instrumental,可循环。
一首带人声的流行歌曲120 BPM、C 大调、昂扬的合成流行赞歌,明亮的女声人声——歌词主题:在城市灯光下追逐梦想。
一段电影预告片配乐史诗感预告片配乐:交响弦乐、太鼓和高亢合唱,从安静的张力铺垫到巨大的高潮。
一段平静的背景垫乐温暖的氛围音景,渐变的铺底、柔和的环境采样、远处的钢琴母题——温柔、不打扰,适合旁白。
一段 EDM 音乐节式 drop128 BPM 的音乐节感前卫浩室 drop,亢奋的 supersaw 主音、侧链低频,大篇幅铺垫。

Suno 的 prompts 换到别的生成器还管用吗?

大体上可以,而且在你费劲收集之前值得知道这一点。那套在 Suno 圈里流通的 prompt 词汇——流派+速度+配器+情绪+制作年代——并不属于某个特定模型。它描述的是音乐;而所有基于文本的生成器,训练时看的都是音乐的描述。一个在某工具里出了你喜欢结果的 prompt,换到另一个里通常也会产出能一眼看出亲缘的结果。

不通用的是那些带中括号的控制语法。像 [Verse]、[Chorus]、[Bridge] 这样的结构标签,以及单独放在样式栏里的风格标签,都是界面约定而不是通用标准:一个生成器把它当指令,另一个可能把它当要唱出来的词。换工具时,保留描述,去掉括号。

可移植的核心很短:说清流派、说清一个 BPM 速度、点两三样乐器、点一个情绪、说明要不要人声。其他都是“方言”。

离谱不远却不对味,怎么救

把微调当混音,不是重写。一次只改一个变量,重新生成,再对比。能量不对,就先改情绪词或速度;某个乐器太抢,就直接点名你要的乐器,而不是随手删词。

把好用的 prompt 留下来——它们就是可复用的模板。时间久了你会攒出一套小词库,能稳定产出你最常用的风格。

  • 太笼统?加细节——BPM、调性、点名的乐器
  • 感觉不对?先换情绪词,再动别的
  • 混得太乱?只列你想被突出呈现的乐器
  • 人声不对?把性别、音色、歌词主题说清楚

用 AI 来写 prompt 本身

卡住了?我们的免费 AI Prompt Generator 能把一个大概想法变成结构化、细节齐全的 prompt,你可以直接粘贴进工作室里用。它能让你很快摸到哪些套路有效——再在此基础上微调。

prompt 写好了,就在 MusicGenerate 里生成:免费、免版税,支持 30+ 种语言的人声。

怎么写真有用的 AI 音乐提示词 — 常见问题

什么才是一个好的 AI 音乐 prompt?

在流派、速度、调性或情绪、乐器、人声类型、制作年代这些维度上够具体。点名五样具体信息,永远比一句不点名任何要素的“诗意”句子强,因为每个含糊的形容词,都是让模型替你做主。

prompt 里要不要写 BPM 和调性?

只要速度重要,就写上 BPM —— 模型对明确的数字比“upbeat”这种词靠谱得多;不同风格对这种词的理解可能能差六十拍。除非这条曲目要和别的素材并排,调性没那么重要。

怎么写提示词才能指定人声?

别写歌手名字,直接写声部和演唱方式:比如“female alto, breathy, close-mic'd”。这比任何风格标签都更能推动结果。演唱方式是对人声最有效的一条指令。

为什么每次结果都不一样?

采样本来就是随机的,所以相同的提示词也会产出不同版本。把它当成探索想法的方式,用得上的先保存,再点重新生成。

负面提示词在音乐生成里有用吗?

很少有用,而且经常反着来——你一说到某样东西,它更容易被召来。换成正向的表达:别写“no drums”,而是要求“稀疏的编配”。

提示词里要不要写艺人名字?

不要。大多数平台会过滤艺人名,这些词会被直接丢掉,你还白白占了字数。描述真实的声音本身——配器、制作、演唱方式——到处都管用。

AI 音乐提示词多长合适?

20~40 个词,覆盖风格、速度、乐器、人声和情绪。再往上添只会稀释那些真正起作用的词。

来源与延伸阅读

  1. 1.MusicGenerate — AI 提示词生成器收录于 2026 年 6 月

把指南付诸实践

理解这些最快的办法:先生成一首曲目,听听你得到的是什么。