给 AI 音乐模型写歌词和风格描述有一套朴素的章法:结构标记、具象意象、少而准的风格词。
2026-08-12 · 约 6 分钟读完
在我们的音乐生成工具里,决定成曲质量的是两块输入:歌词和风格描述。很多人把精力全花在风格词上,其实歌词的结构对成品的影响更大——模型是按你给的段落结构去编排主歌、副歌的。
写歌词时明确标注段落结构,例如「[Verse 1]」两段、「[Chorus]」副歌、「[Bridge]」桥段。有了标记,生成歌曲的起承转合立刻清晰。
意象要具体。「夏夜的风穿过便利店门口」比「我很难过」更有画面感,也更容易被谱上贴合的旋律。副歌部分写重复性强、情绪浓度高的短句,这是流行歌曲hook的基本规律,模型对这种规律响应很好。
先写副歌再写主歌是个好习惯。副歌定了,整首歌的情绪基准就定了。
风格词三个左右就够了:「citypop,女声,日语」或者「民谣,木吉他,男声,慢速」。堆上十几个形容词(伤感 + 治愈 + 摇滚 + 轻快)只会让模型无所适从。
一个实用技巧:风格冲突时,把最想要的一个放最前面,权重最高的位置。想要「干净的编曲」,就把 clean arrangement 写在最前。
第一次生成不满意时,别整段重写。先判断问题出在哪:旋律不对,调风格词;情绪不对,调歌词意象;结构乱,检查段落标记是否清晰。每次只动一个变量,你才能知道是哪个改动起了作用——这和调试代码是一个道理。