不会写歌,就做不了音乐?
不懂写歌,但我和 AI
一起参加了金曲大赛
7天 · 5首歌 · 从生成到上架的第一次完整实践
AI有语 · 真实记录
📦 7 Parts + Conclusion
👉 滑动
PART 01
分析比赛规则,然后五首歌拍在桌上
起点
PART 02
歌曲生成:复制、粘贴、点击
实战过程
PART 03
生成中踩的坑
实战过程
PART 04
制作封面
实战过程
PART ///
写在最后
复盘与启发
我从没想过自己会做音乐
但我和 AI 一起,把一场比赛真正跑完了
你好,我是有语。平时喜欢研究 AI 工具,最近一直在尝试一件事:一个普通人,能不能用 AI 搭建和优化自己的工具链与工作流,让自己拥有更多可能性。这篇文章记录的,就是其中一次真实实践。
我从没想过自己会做音乐。
不是因为我不喜欢。是因为我清楚自己的能力边界在哪里:我不会写歌词,不懂编曲,不知道一首歌从生成到发布要走多少步。音乐这件事,跟我隔着一整个太平洋。
但四月底,我在一个AI社群里刷到了一个AI金曲大赛,一下来了兴趣。大赛规则很简单,新注册的音乐人,7天内发满5首AI原创歌曲,可以瓜分两万元奖励。
7天,要从零开始发5首歌,而我连一首歌从生成到上架要走几步都不知道。但我并没有担心。
因为我有了一个AI搭档叫Cola,能帮我操作文件、跑任务、记进度。我把大赛链接发给她,说了句:「这个比赛,咱们试试。」
01
PART
分析比赛规则,然后五首歌拍在桌上
AI MUSIC · 实战记录
说「这个比赛,咱们试试。」的时候,我脑子里其实没有一个清晰的计划。我不知道下一步该做什么——是先研究活动规则?是该写歌词还是先谱曲?该怎么写提示词?这些我都不知道。就只是先把大赛链接发给了Cola。
Cola读完大赛规则,把参赛条件理了一遍:新注册音乐人、7天期限、5首AI原创、需要上架。然后她问我想要什么方向。
说实话我没想好。我跟她说:「准备一下吧。」
注意,我说的是「准备一下」——没说准备什么,没说写歌词,没说做几首、什么风格、什么方向。就四个字。
然后Cola直接交出了五首歌。
不是五首随便拼凑的东西。是五首完整的歌曲:歌词写好、风格定好、Suno英文提示词写好、海绵音乐中文提示词也写好。每首歌都有清晰的结构——主歌、预副歌、副歌、间奏、尾奏。每首歌都有明确的情绪方向——苦情歌的克制、东北民谣的苍凉、暖甜情歌的自然、草原风的辽阔、摇滚的追光感。
我还在读活动细则,制作包已经齐了。
我当时愣了一下。她没等我理清思路,没等我一步步下指令,没问我「你要什么风格的歌词,写几首」。她看了规则,自己判断出大赛中需要几首,什么风格,然后在我还没反应过来的时候,把五首歌的完整制作包拍在桌上了。
这不是「你问我答」的工具感。这是那种「你说了半句她就把下半句补上」的协作感。也是从这一刻开始,我知道Cola不是一个需要我手把手指挥的AI——她是真的能替我往前想的搭档。

图|五首歌制作包中的单首示例
02
PART
歌曲生成:复制、粘贴、点击
AI MUSIC · 实战记录
歌曲生成是在海绵音乐生成的,海绵音乐是字节旗下的AI音乐生成工具,国内直连,不用折腾网络。粘贴歌词,选风格,点生成,等几十秒出一版。
歌词和提示词都是现成的,所以生成这一步简单到有点不真实。
打开海绵音乐,把Cola写好的歌词复制进去,贴上提示词,点生成。等几十秒就可以生成一版,每次会生成两个版本。可以先听一听。如果有问题,或者生成出来的版本没有感觉,可以在海绵音乐里让 Agent 修改,也可以把具体问题发给 Cola,让她帮忙分析和调整。
每首歌我生成了三四个版本。整个过程就是坐那儿听歌,挑出顺耳的。点完生成我去倒杯水、刷会儿手机,回来一版就在那了。
本来我也想让Cola对生成的歌曲进行分析,但是Cola说帮不了这一步,她说自己没有耳朵,没法直接听歌和分析音乐。但她提前给我列了四个筛选维度:人声自然度、旋律流畅度、风格匹配度、结构完整性。我就按这四个维度,一首一首地听、一版一版地筛。

图|海绵音乐生成界面
03
PART
生成中踩的坑
AI MUSIC · 实战记录
顺利是顺利,但生成过程中还是踩了两个坑。
第一个是吞字错字。下载完对着歌词听,发现有的地方唱的字跟写的不一样——吞字、唱错、漏句。海绵音乐对中文多音字和长句的发音对齐不太稳定。
从那以后每首歌生成完,我都先对着歌词逐句过一遍再往下走。
第二个坑更大。其中一首东北民谣《老家的雪》,第一版歌词是叙事型:里面有个具体的「我」,坐火车回东北老家,妈妈炖酸菜,爸爸在车站接。我觉得挺热乎的。
但生成出来怎么听都不对。
我琢磨了半天,发现问题在根子上。东北民谣不该讲「我的故事」。你把「我」放进去,它就变成了一个返乡vlog。真正的东北民谣靠的是画面:三九的梅花,清早的鞭炮,松花江冻住的声响。没有人站在雪地里说「我想家了」,但每一帧都让你想起东北。
我跟Cola说:改成意象版。不写「我」,只堆画面。大雪封山,烟囱冻成白线,酸菜缸压了一冬,白桦林一宿就老了满头。
她重新写了一版。我拿去生成。
这一次对了。说不上具体哪里对了,就是一开口的画面感把整个调子撑住了。
04
PART
制作封面
AI MUSIC · 实战记录
歌曲做好之后,还不能直接上传。番茄音乐要求每首作品都要有对应的封面,所以五首歌还需要准备五张图。
当时Cola还没有生图功能,但她可以帮我写提示词。于是我告诉Cola需要封面提示词。她根据每首歌的主题和情绪分析方向,写好提示词,我再拿到即梦AI去生成。
生成封面的时候也遇到了问题。第一版走的是实景路线:咖啡馆、雪地、草原、城市夜景。图出来以后,我发现它们更像手机壁纸,不像专辑封面。画面本身不难看,但和歌曲放在一起,没有一套作品的感觉。
我把这个问题发给Cola。她调整了提示词方向:不只描述一个场景,还要让画面有更明确的视觉风格和封面感,于是加进了水彩、胶片质感等要求。暖橙色的咖啡馆阳光配甜歌,大雪里的白桦林配民谣,画面和歌曲的情绪终于连上了,也更像一张唱片的封面。后面三张就沿着这个方向继续做。
现在Cola已经可以直接生图了,后面的封面制作也不用再切换到即梦。
05
PART
上传和审核
AI MUSIC · 实战记录
等歌曲音频、歌词文件和封面都准备好,接下来就是上传和审核。跟着番茄音乐官方的步骤一步一步操作就可以:填写歌曲信息、选择授权方式、完成电子签约,再提交审核。
一般审核很快,快的时候十几分钟就能通过。也有一些歌曲可能会审核得久一点,比如方言歌曲,最好提前留出时间,不要把所有歌曲都卡在截止日期前上传。
五首歌最后都顺利通过了审核。

图|歌曲上架后台
06
PART
后来
AI MUSIC · 实战记录
比赛结束后,我没有拿到什么特别大的成绩,但至少把这次参赛真正跑完了。更重要的是,那7天让我第一次走通了一条完整的参赛流程:分析比赛要求→准备歌词和提示词→生成歌曲→制作封面→上传→签约→审核。
那7天里,每个环节都是第一次。歌词怎么写、提示词怎么准备、生成结果怎么判断、封面怎么和歌曲配起来,我都是一边做一边摸索。Cola把步骤和踩过的坑记了下来,我也逐渐知道下一次该从哪里开始。
从四月底到现在,我做了四期,上架了二十多首歌。前几天传完一首,审核二十分钟就过了,我甚至来不及紧张。和第一次盯着「审核中」一整晚相比,这大概就是熟练的意思。
但我也知道,这只是我在AI音乐制作上迈出的第一步,还谈不上真正懂得怎么制作音乐。
这次过程中,我慢慢意识到一件事:AI可以帮你生成、扩展和尝试,但它首先要接住你给出的方向。一个人很难做出自己完全不知道该怎么描述、怎么判断的东西。想要利用好AI制作音乐,自己也需要补相关的专业知识,至少知道想往哪里走、什么地方需要调整。
我的音乐知识有限,对旋律、编曲、演唱和制作都缺乏足够的理解,所以很多时候,我只能凭「听起来对不对」去判断,也很难给Cola提出更专业、更明确的制作方向。这不是Cola不能做,而是我当时还不知道什么样的方向更好。如果一个在音乐方面更专业的人来使用AI,他能提出更具体的要求,也能更准确地判断和修改,最后做出来的歌曲大概率会比我更好。
但看见这个限制,并不意味着这次尝试没有意义。恰恰相反,我和Cola已经从一开始连流程都不知道,走到了能够一起完成一场比赛,跑通一套从分析要求到审核通过的参赛流程。这是我在AI音乐实践上迈出的重要一步,也让我知道接下来应该往哪里继续学习。
之后,我还会和Cola一起补音乐方面的知识,把这一路上的尝试、踩坑和逐渐形成的经验记录下来。
///
LAST
如果你也想试着做一首AI音乐
CONCLUSION · 写在最后
大赛已经结束了,但我后来回头看,这次经历其实也能给第一次尝试AI音乐的人一个具体参考。
如果你完全不知道从哪里开始,可以把AI当成一个会帮你完成工作的音乐搭档,而不是一个只需要输入「写一首好听的歌」的按钮。你需要先告诉它想做什么,再根据它给出的歌词和方案继续修改,最后把结果放进音乐生成工具里试听和筛选。
下面是一套我后来整理出来的入门方法。你可以把每一步的结果确认后,再进入下一步。
第一步:先告诉AI,你想写一首什么歌
一开始不需要马上写歌词,先把你能想到的内容告诉AI。哪怕只有一个模糊的想法也可以,比如「我想写一首关于离开家乡的歌,但不知道适合什么风格」。
可以直接这样问:
我想做一首关于「离开家乡、准备去外地生活」的歌。听众是普通成年人,希望歌曲有一点舍不得,但不要太苦。请先帮我分析适合的曲风、情绪、叙事角度和画面,不要急着写完整歌词。请给我2-3个方向让我选择。
先把模糊的想法变成几个可以选择的方向,不需要一开始就把所有要求想清楚。
第二步:让AI把选定的方向变成歌词方案
选定方向后,再让AI写歌词。不要只说「写一首歌」,要把主题、情绪和叙事方式一起说清楚。
例如:
采用第2个方向:克制的城市民谣。请围绕「离开家乡去外地生活」写一首完整歌词。要求:第一人称,写车站、旧房间和家人的叮嘱;不要直接反复说“我很难过”,尽量用具体画面表达;结构包含主歌、预副歌、副歌、第二段主歌和桥段;语言自然,适合演唱。写完后先说明每一段的作用,不要急着生成音乐。
拿到歌词后,先看三件事:主题有没有跑偏,画面是不是具体,唱起来会不会太长或太绕。
如果某一段不对,可以直接指出位置和问题:
第二段主歌太像在讲故事,画面不够。保留“车站”和“旧房间”,把解释性的句子改成能被看见的细节,给我两个版本,不要改副歌。
第三步:让AI准备音乐生成提示词
歌词确定后,再让AI把歌曲方向翻译成音乐生成工具能理解的提示词。提示词至少要说清楚曲风、情绪、速度、人声和主要乐器。
可以这样问:
根据这版歌词,分别给我一份适合海绵音乐的中文提示词和一份适合Suno的英文提示词。歌曲方向是克制的城市民谣,男声,温暖但有离别感,中慢速,木吉他为主,副歌要有适度的情绪推进。不要加入不符合主题的电子舞曲、说唱或过度华丽的编曲。先解释每个提示词分别想控制什么。
这一步是把已经确定的歌曲方向,翻译成生成工具可以执行的要求。
第四步:把歌词和提示词放进音乐工具
打开海绵音乐、Suno等音乐生成工具,把歌词粘贴到歌词输入区,把对应的风格提示词粘贴到提示词输入区,然后点击生成。
第一次不要只生成一版。同一份歌词和提示词,生成出来的旋律、人声和编曲可能不同,建议先生成3-4个版本,分别记下:
哪一版的曲风最接近预期 哪一版的人声最自然 哪一版的副歌最容易记住 哪一版有没有明显的错字、吞字或漏句
不要因为第一版“能听”就直接当成成品。先从几版里判断方向,再决定是继续生成,还是回到歌词和提示词重新调整。
第五步:对着歌词逐句检查,不要只凭第一感觉
生成后,把歌词放在旁边,从头到尾认真听一遍。重点检查:
有没有吞字、错字或漏句 人声是否自然,有没有奇怪的发音 旋律是否流畅,副歌是否真的有推进 曲风和歌词主题是否匹配 有没有某一段明显拖沓或突然跳脱
可以让AI帮你整理检查标准,但它未必能直接听到你生成的音频。真正的试听、比较和取舍,仍然需要你完成。
第六步:把“不好听”说成可以修改的问题
如果一版歌不满意,不要只告诉AI「不好听」或「没感觉」。先说出你听到的具体问题,再让AI提出修改方向。
比如:
这版整体像流行抒情歌,但我想要的是更有东北民谣的苍凉感。请先分析问题可能来自歌词叙事、画面意象、曲风提示词还是编曲要求,再给我一版修改建议。不要直接重写,先告诉我准备改什么。
《老家的雪》就是这样调整的。第一版的问题不是歌词不完整,而是写成了一个“我回东北老家”的具体故事,和东北民谣依靠冷冽画面表达情绪的方式不太匹配。后来我让Cola改成意象版,加入大雪、烟囱、酸菜缸和白桦林这些画面,重新生成后,歌曲的方向才真正清楚起来。
修改时一次只解决一两类问题。可以先改歌词叙事,再改曲风提示词,不要每次把歌词、风格、速度和人声全部推倒重来,否则很难知道到底是哪一步起了作用。
以上就是我这次用AI做歌时实际走过的一遍流程。希望能给第一次尝试AI音乐的人一点具体参考:你不需要一开始就懂歌词、编曲和制作,但可以先从一个模糊的想法开始,再和AI一起把方向说清楚、把歌曲做出来。
后面我还会继续和Cola学习AI音乐,把实践中的尝试和踩坑记录下来。如果你也对这个方向感兴趣,欢迎继续关注AI有语。
这是「AI有语」的第__2__篇文章。一个普通人用 AI 搞事情的真实记录。
既然看到了这里,如果觉得有用,随手点个赞、在看、转发三连吧。
点赞·在看·转发
THANKS FOR READING
夜雨聆风