ARTICLE · 1114867
第三章:让AI帮你唱歌,圆一个你不敢做的梦
#我为家乡做个动漫MV #长寿区 #三倒拐 #长寿缆车
歌词是骨架,旋律是血肉。
之前我已经把《长寿谣》的骨架搭好了——三倒拐的实,人生路的虚,"渐→易→已"的三重递进,"追"与"催"的反复追问。现在,我们要让这副骨架长出血肉。
这里我先声明一下,我对音乐兴趣不大,对乐理一窍不通,只是一位喜欢画漫画的设计师。简单说,就是搞广告的。
视觉是我的强项,歌词我也能套用广告文案技巧给你讲得头头是道,唯有音乐,我只能说咱们探讨探讨。
3.1 AI不会读心,但它会数数
先确定一个底层逻辑:AI生成旋律的本质,是文本结构的声学翻译。
AI看不懂"乡愁",但它数得清字数。AI感受不到"释然",但它识别得出断句。你写"上城头,下河街,爬坡上坎三倒拐",AI翻译成的旋律就是"平稳推进,最后一拍微微上扬"。你写"人生好似三倒拐,一步一坎看不到头",AI翻译成的旋律就是"先沉下去,再扬起来"。你写"已经白头发多,黑头发少",AI翻译成的旋律就是短促、干净、不拖泥带水。
我们在第一章谈控制字数和断句,不只是为了朗读好听,更是在预埋旋律的DNA。你字数和断句控制好,它就能唱对。
所以这一部分我们的核心任务是"用你已经写好的歌词,去调教AI"。
整首丢进去,出来一锅粥
我认为AI生歌,至少免费生歌最大的误区:把完整歌词复制粘贴,选一个风格,选一种音色,点生成。
这样做的结果,就像把前菜、主菜、甜点倒进一个锅里煮。能吃,但分不清层次。主歌的叙事、副歌的爆发、过渡的宣泄,全被同一套旋律逻辑碾平了。
我的直观感受是AI歌手喜欢炫技,就喜欢在唱腔上耍花腔,转音转、尾音也喜欢转。但整体旋律的情绪该顶的顶不上去、该压的压不下去。
我认为正确做法是分段生成。
但分段不是按句子拆,是按功能分:前奏、主歌A、主歌B、预副歌、副歌、过渡。一次只处理一个部分,生成的情绪才更饱满,我们可以不管前后旋律合不合得上,先找对感觉,咱们非专业选手就只能走体验派,别去搞技术流。
3.2 先找骨:哪段是耳朵的钩子
《长寿谣》的骨是:
主歌骨:"爬坡上坎三道拐"。
副歌骨:"人生好似三道拐"。
那么关键段落就是两根骨所在的主歌B和副歌。很明显"上城头,下河街,爬坡上坎三倒拐"段落朗朗上口,而且包含两层递进,是整首歌重复最多、最需要抓耳的关键组成部分。虽然"时间匆匆过"也重复了四次,而且是预副歌,但它字数少、句子短、结构简单,可以用来洗脑,但无法作为撑起整首歌的主干。
我是先用豆包(生歌)生成了多段歌曲片段来挑选感觉最对的一版。选这段还有一层考虑,我得测试"街"用"该"来发音AI认不认,是用"该"替代"街"就行了,还是必须用"活该"替代"河街"。结论是都行,能认的时候都能认,不认的时候都不认,甚至后期使用海绵音乐翻唱时,它还多次将其纠正为"河街"。根据我的观察,大概率是翻唱我给了完整版歌词,它结合前后文将"桃花该"识别为"桃花街"的笔误,然后自动推导出"河该"是"河街"的笔误。
哪怕AI无法用四川话演唱,有几个涉及方言韵脚的关键音能同音字替换,也勉强能成立。一旦不行,就得改词,甚至动结构。因为一旦歌词里"该"没有了,"湖"和"老汉"就没有了,"坝坝舞"、"倒倒胡"、"三缺一"、"夕阳红"就都不成立了。这些市井烟火没有了,这首歌就只是一把塑料玩具刀。
万幸,虽然麻烦点但好歹实现了。
3.3 再试音:副歌是改出来的
第二段我生成的是副歌。副歌最大的问题出在"已经白头发多黑头发少,白头发多黑头发少"的断句上。
事实上"人生如戏莫入戏,曲终人散三缺一"也是在这里的调整过程中加进去的。如果你注意观察这一段歌词:
人生好似三倒拐,一步一坎看不到头。
而今从头来,不过三道拐,不过三道拐。
人生如戏莫入戏,曲终人散三缺一。
往事总在心头绕,抬头低头莫要回头。
已经白头发多 黑头发少,白头发多黑头发少。
除了这一句全是"头"。原版歌词其实是这样的:
重庆有匹菩提山,山下有座长寿城。
长寿人 吹得神,人人向往长寿的人。
长寿人未必都是长寿的人,
都是长寿的人。
(老子都是长寿的人)
读小学,上初中,呼朋唤友埋头冲,
年复一年春到冬,望子成龙破浪乘风。
火车站,船码头,骑鞍车站再回首,
妈和老汉都没走,提起背包我抬起头,大步向前走。
上城头,下河街,爬坡上坎三倒拐。
新城新 老城老,事事如新人易老。
上城头,下河街,爬坡上坎三倒拐。
新桥新 老桥老,事事如新人已老。
寿星广场夕阳红,向阳路上三缺一,
人生如梦滚滚红尘谈笑之间待余生,过一生。
人生好似三倒拐,一步一坎看不到头。
而今从头来不过三道拐。
往事总在心头绕,眉头心头莫要回头。
已经白头发多黑头发少。
桃花城 桃花街,桃花河畔花落少,梦里花落知多少,知多少。
望江桥 望江路,望江亭上江水流,滔滔江水向东流,向东流。
菩提灯 菩提庙,菩提古镇看热闹,姻缘牵线找月老,找月老。
天台寺 天台山,天台点灯拜菩萨,菩萨保佑我发大财,发大财,要发大财。
三洞沟,城门洞,凤山公园走一走。
偷偷摸摸手拉手,少年心事都在心头。
处对象,耍朋友,牵手漫步新桥头。
年复一年春到冬,半生风雨要长相守,一起到白头
(重复段落)
已经白头发多黑头发少,白头发多 黑头发少。
重庆有匹菩提山,山下有座长寿城,
长寿人 吹得神,人人向往长寿的人,
(老子都是长寿的人)
长寿 的人
都是四川方言这里念"斗是",是"不管怎么就是"的意思,原词里这段副歌是对仗加重复,起扩扩 收扩扩收的结构。四句有十个"头",副歌嘛应该要强化节奏感的。是调整这段歌时,不断尝试改成了最后这样。也是因为垫了一句"人生如戏莫入戏,曲终人散三缺一"才不得不在之前垫两句"时间匆匆过"。原本"人生好似三倒拐"是直接接"过一生"的。
歌词修改过后,才不得不将副歌洗脑的功能转交给了"时间匆匆过",让它在结构上也重复四次,作为缠绕在(渐老→易老→已老)这条主干上的藤蔓。
3.4 川渝说唱到故乡民谣
你看原版的歌词韵脚主要集中在ou、ong、ao、an、ang、ai上,搭配少量en eng,是强调节奏感的,我一说GAI、布瑞吉的川渝说唱你就懂了嘛,一个对音乐不感兴趣的重庆中年老登怎么可能一开始就想给你搞民谣嘛,耿直、豁达、江湖、爽快,没打算捅你刀的,"寿星广场夕阳红,向阳路上三缺一",寿星广场就在向阳路上,长寿的标志性雕塑寿星老人就竖立在那里,我只是客观描述了老伙伴们相约跳广场舞的情境,走着走着哪天就少了一个人,就像打麻将少了人个人一样,需要找新搭子了,生活还要继续,太阳照常升起,并没有"柴家山前慢些走"的会心一击。
节奏也是一样,主歌A段是3 3 43 43 44的起扩平扩的重复变调,主歌B段是3 3 43 3 3 43的平平扩 收平扩的重复,预副歌43 43 4443 3的平平扩收,副歌是43 44 244的平扩扩的重复(第二遍43 44 244 4 4的平扩扩收平尾句重复变调),中间过渡(说唱)部分是3 3 43 43 3的平平扩平收,尾句3 3 43 44 3 4的平平扩扩收扩,虽然主体结构起伏不大,但关键句张力是够的,比如"人生如梦滚滚红尘谈笑之间待余生,过一生",但一切变化就发生在反复尝试副歌尾句"已经白头发多黑头发少"和"已经白头发多黑头发少,白头发多黑头发少"这一句两段不同的唱法上,第二遍只是加了一句重复句,AI处理第一段时会自己加和音重复会重复"头发少",我当初听到这个和音差点笑喷了,或者他会断句为"已经白头发多,黑头发少"重复"黑头发少",反而第二段加了明确"白头发多黑头发少"的重复句反而处理得不错,当我决定第一段也这样重复时,副歌整体感觉就变了,为了让两遍副歌产生递进效果,我才开始了加垫句和变词位,磨细节自然得上技巧,恰恰我作为广告人最擅长玩技巧,不就是含义、功能、韵脚嘛,我没有文艺工作者那种完美的追求,一切以整体目的为准,比如易已的双层重复递进,变为"渐易已"的三层叠加递进,"易已"这种同音异义字宛如神来一笔,但我一点都不纠结,变三层我就加"渐",文字上可能不美、韵律上可能不搭,但它功能强啊,既然要变,结构上"易已"怎么都组合不出"渐易已"的三层叠加递进效果来,要效果好功能就是第一位的,其他的统统靠后,这是广告思维。
当然牵一发动全身,变民谣以后我对每一段甚至歌曲结构都进行了调整,"找月老"、"拜菩萨"、"发大财"这些江湖气很重的词全换了。
所以你看,生歌的过程会逼你改词。不是先写词再生歌,是词和曲互相打磨。有时候AI唱不出来的,你改一改,反而比原来更好。
3.5 治花腔:用歌词逼AI闭嘴
为什么一句"已经白头发多黑头发少,白头发多黑头发少"就逼得我不得不大动一番呢?当然一方面是我意识到,在传播上做成民谣适配度会更广,我也不只是可以做首歌自我表达式的在小圈子里玩玩,民谣我完全可以做成动漫MV扩大传播,动漫、传播不就是我最擅长的吗?比如我可以做成一套你也可以做的教程教别人做,故乡民谣、动漫MV、零门槛、零花费,这玩意的吸引力大概率比我这首歌本身还大。另一方面AI歌手有个毛病,当然也可以说是特点吧,喜欢在句尾耍花腔,副歌收尾尤其严重,什么是耍花腔呢,就是拖尾音加转音来炫技,事实上AI歌手最大问题是情绪上该上上不去、该压压不住,只有靠这些细节处理来掩盖,我以前看一个音乐节目听一个专业创作人解释过,专业歌手和业余歌手最大的区别就是在尾音的处理上,你要耍花腔并不难,天赋加努力嘛,但专业与否的区别在克制,是歌曲这里需要我怎么处理,而不是这里我可以炫技。
比如过渡段我原本是想方言说唱,一方面方言说唱难度太高,另一方面风格变民谣了,所以我给"滔滔江水它向东流",加了个"它"来转折,每一句相同位置都加了,并对尾句进行了调整,我希望AI可以在每句句尾,和声叠一句"向东流"就收。但加字以后AI就开始转音、拖拍。
因为有了"头发少"的经验,我的办法比较粗暴:直接在歌词里加收的重复句。
桃花城桃花街,桃花河畔花落少,梦里花落不知多少,知多少。
望江桥望江路,望江亭上江水流,滔滔江水它向东流,向东流。
菩提灯菩提庙,菩提古镇看热闹,姻缘牵线来拜月老,拜月老。
天台寺天台山,天台点灯问神仙,菩萨保佑我挣大钱,挣大钱,要挣大钱。
不是我想凑字数,是用歌词给AI下指令——唱完这句,给我收住,不许耍花腔。
"望子成龙破浪乘风,乘着风。"
"大步向前走,向前走。"
"少年心事都在心头,上眉头"
"一起到白头,到白头。"
都是这么处理的,歌词字数也是这么上去的,不是凑字数,而是下指令。AI的反馈也很直接,他有可能漏唱重复句,但它一定能收得干脆。
3.6 拼接翻唱
当然前奏和过渡两部分也是关键段落,必须单独生成。改过歌词后。前奏"重庆有匹菩提山"是按童谣来的,过渡的叠句是按R&B来的。
整体逻辑就是核心段落最重要,比如副歌,副歌旋律对了、立得住了,这首歌才可能成。当然我的实操是先生主歌B,不是我违反逻辑,而是我说过这是一次方言测试,优先级更高,而且我这段主歌B结构上比副歌更像副歌。
副歌推预副歌,副歌整体立主了,反推主歌或单独生主歌拼接两者都可以,再用第一遍主歌推第二遍主歌,再把副歌加进去整体结构拼接好,让海绵音乐翻唱、整合。如果跟我一样前奏、尾奏、中间段有词,同样的逻辑,反推单独生拼接都可以,最终按照完整结构剪进去就行。
这里就会产生一个问题,我们要怎么将歌词喂给AI,AI才看得懂。
3.7 标签不如结构
AI生歌最大的问题是:它不认段落名,只认文本顺序。你写"【主歌A段】",它看不懂。它只看到一堆词,按先后顺序排列。想让AI识别出重复段落、高潮段落,你必须用歌词本身的排列方式来给它指令。
我试过在歌词前面标注"主歌"、"副歌",或者用英文标签[verse][chorus]来告诉AI。
实测结果:中文标签"主歌""副歌",AI几乎不识别。英文标签[verse][chorus],效果比中文略好,我问过其它AI,AI给我的结论是:AI能认出了这是"chorus",但它不知道怎么处理这个信息。标签只告诉AI"这段叫什么",但没告诉它"这段该怎么唱"。很明显我们不可能在歌词里直接标注这一段要怎么唱,我认为旋律的起伏、情绪的推进,AI是从文本本身的字数、断句、位置、重复结构推算出来的。
这里有个传说,为什么是传说呢?因为是AI告诉我的,据AI称“|”可以在生歌时帮助AI为歌词断句,因为我的实际感受不明显,所以后期直接放弃了这个方法,究竟有没有用总得自己试过才知道。
我的结论:AI真正能读懂的是文本本身的数学结构,不是备注。
在实操过程中我发现,副歌相同的词海绵音乐会直接重复旋律,有变化但情绪没有叠加,所以我才通过调换词位和强化递进来让它产生变化,"渐→易→已"的两层递进也是这么来的,看用字就知道原本只有"易→已"两层。
当然结果也很恼火,这一调歌词就超过了千字,歌词一旦超过限制,AI处理起来就容易过载导致后半段崩掉,关于这个我没啥建议,比如我就觉得歌词很重要所以哪怕会崩,我宁愿多拼接几次也要保留它的完整性,因人而异、各自磨合。
在这个和AI的磨合或者说博弈过程中我发现了三条规律:
规律一:重复段落推导
主歌A段有两遍,歌词不同,但结构相同。如果你把完整歌词丢给AI,因为间隔太远,非常容易导致前后两遍的曲调误差变大,无法统一。但同段落对仗的句子却很少出现类似情况。
因此我总结了两种方法供大家参考:
段落字数多可以使用"1A—2A—1A—2A"的方式,来找出最匹配的1A、2A段落。
段落字数少可以使用"1A—2A—1A—2A—副歌",或者"1A—2A—1A—2A—1A—2A"的方式反复推导合适两遍完整主歌。当然两种方法也可以交叉组合使用,比如"1A—2A—副歌—1A—2A—副歌",甚至"主歌第一遍—主歌第二遍—副歌"的方式,一次推导完整主歌,再用相同方式直接第一遍主歌推第二遍主歌。
规律二:相邻段落推导
前面我提到了副歌推预副歌,我没细讲方法,是因为通常预副歌都是相同的重复段落,如果是预副歌推副歌(包含变句或词位变化),以及主歌AB段互推要怎么办呢?
将我们已经生成的满意的片段作为参考,搭配相邻段落的歌词一起发给海绵音乐,
比如我们有主歌1A,就以可以以"1A—1B—1A—1B"或"1A—1B—1A—1B—副歌"、"1A—1B—副歌—1A—1B—副歌"的方式匹配出合适1B,因为通常1A—2A是重复或重复变调,而1A—1B则是重复变调或递进,甚至有些歌词1A1B的结构完全不同,所以不能复用第一套逻辑。
副歌类似,如果我们有预副歌或副歌,有不变的就用不变的去推有变化的,有变化的就用变化的先推出不变的,再用不变的反推两段变化的,因为不变的是用来重复抓耳的,是整首歌最核心的部分。
规律三:副歌推导
事实上我们说过副歌重复的部分使我们需要优先生成的段落,只有这一段立住了,我们的歌才可能成立,副歌是全曲情绪最饱满的部分。所以我们一开始在使用豆包(生歌)时就不能只给豆包需要生成段落的歌词,比如副歌重复,那么我们就必须给豆包"1B—副歌—2B—副歌—副歌"、"预副歌1—副歌—预副歌2—副歌—副歌"、甚至"1B—预副歌1—副歌—2B—预副歌2—副歌—副歌"的歌词来找出满意的副歌,整体逻辑就是先定段落旋律,再推层次变化。
3.8 先找感觉,后磨细节
理论上AI生歌有两个阶段:旋律生成和音色合成。旋律不受音色影响,你选"男声"或"女声"生歌的旋律本身是一样的。
事实上我说过我们是体验派、而不是技术流,感觉很重要,豆包(生歌)有三个选项风格、情绪、男女,它的组合效果是不一样的,如果你想要慢一点的节奏、压抑一点的情绪,男声效果比女声好,同理你想要快一点的节奏、快乐一点的情绪,女声效果比男声好,我的感觉是男女声不同的发声区域会影响AI生歌的曲调,也就是说哪怕你想要一首女声唱的悲伤的歌,用豆包(生歌)生成时选男声,海绵音乐翻唱时再用女声翻唱,效果会比豆包(生歌)时直接选女声要好很多,因为调子可以压得更低一点。当然我不懂乐理,这只是我的个人感受,没有理论支撑。
因此我们这种体验派先给歌找到合适的感觉,才是最重要的,感觉对了,再到海绵音乐单独调整翻唱音色,效率会更快一些。
不同段落给不同风格指令,豆包(生歌)给我们提供了足够的预设标签,我们可以组合得出结果,这也是虽然海绵音乐也免费,但我建议从豆包开始的原因,省去写提示词的环节。
风格:流行、嘻哈、国风、DJ、摇滚、民谣、R&B、雷鬼、朋克、电音、爵士
情绪:快乐、放松、活力、兴奋、忧郁、鼓舞、伤感、怀旧、浪漫
我们不把它们当作风格和情绪标签(风格情绪后期海绵音乐来处理),就当做速度调节滑块
主歌快速,就选爵士搭配放松、活力
主歌中速,就选流行搭配怀旧、浪漫
主歌慢速,就选民谣、国风搭配忧郁、伤感
副歌快速,就选爵士、DJ甚至摇滚搭配兴奋、鼓舞
副歌中速,就选流行搭配快乐、活力
副歌慢速,就选流行、民谣搭配怀旧、浪漫
关键不是每一段都完美,而是每一段的功能要对——主歌负责叙事,副歌负责爆发,过渡负责宣泄,前奏尾奏负责呼吸。功能对了,拼在一起结构就不会散。
操作顺序:
第一步,找感觉。
副歌核心部分。用豆包(生歌),选适合的音色,换不同风格和情绪。
从生成的众多副歌版本里挑出感觉最对味的片段。以该段落为感觉锚点、情绪锚点在海绵音乐里反推其他段落,主歌关键部分以及其它必要段落,与副歌存在较大差异的段落重复第一步单独生成感觉对得上的旋律。感觉最重要,不要去考虑伴奏、旋律衔接的问题,这不是我们这些外行人需要考虑的事情。
第二步,拼接完整版。
用剪映把挑出来的片段拼接成完整版。前后旋律差异太大过渡处加淡入淡出,稍微留出一小段空白过渡。
第三步,翻唱或重制。
把拼接好的粗版导入海绵音乐,用你想要的音色翻唱或重制伴奏。翻唱时可以通过提示词精细控制音色、节奏和伴奏乐器,这里的伴奏一定要标注节拍器、或鼓点这类在波形图上能看到明显节奏的乐器。
第四步,磨细节。
你想在海绵音乐一次就搞出满意的版本几乎是不可能的,最常见的比如演唱时错、漏、吞字词等,所以相同的提示词多生几次,直到所有段落都有满意的版本出现,再次通过剪映拼接这些满意的段落。这时明确的节拍就是我们通过波形图对齐节奏的参考——因为AI每次生成的段落BPM可能有细微偏差,靠耳朵对齐会漂移,看波形图的鼓点峰值才能精确拼接。我们将拼出的这一版,再交给海绵音乐翻唱协调旋律伴奏和人声对齐。
海绵音乐支持提示词控制,你可以指定风格、情绪、音色、速度、配器。比如:
音色描述
"用男生音色演唱,温暖、低沉、诉说感"
"用女生音色演唱,清澈、明亮、空灵"
音色选择的直观逻辑:
温暖、诉说、故事感选男声。
清澈、明亮、空灵选女声。
天真、轻快选童声。
宏大、力量选合唱。
对话感、双线叙事选男声加女声对唱。
节奏控制
"节奏舒缓,BPM 70左右,像在慢慢走路"
"节奏轻快,BPM 100以上,有跳跃感"
伴奏乐器控制
"伴奏以钢琴为主,辅以弦乐,温暖柔和"
"前奏尾奏加入竹笛,伴奏以古筝为主搭配民族鼓,国风编曲"
"用吉他扫弦做伴奏,加入木鱼鼓,民谣风格,干净简单"
海绵音乐翻唱的完整提示词公式:
风格 + 情绪 + 音色 + 节奏/速度 + 乐器/配器
完整示例
"用民谣音乐风格,传达怀旧的情绪,男生音色演唱,节奏舒缓,BPM 65。伴奏以木吉他为主,辅以弦乐组和口琴。"
推荐一套经过验证的民谣乐器组合:
木吉他是民谣的骨架。
竹笛或口琴做间奏或前奏的主旋律,有"风吹过来"的画面感。
手风琴铺垫和声,增加温暖和怀旧感。
钢琴或钢片琴点缀高音,像星光或水滴,增加透亮感。
轻鼓点或木鱼鼓(非洲鼓)做节奏骨架,保持叙述感。
掌声打节拍增加人味和现场感。
节拍器,保持稳定推进。
当然我们也可以让AI理解氛围,而非只认乐器名。
你可以写:
"像坐在院子里,有人弹木吉他,有人吹口琴,远处有手风琴,脚边有节拍器轻轻响着。"
直接发给海绵音乐当作提示词,也可以将之发给其它AI翻译为海绵音乐可以理解的提示词,卡住了先问自己,自己解决不了就问AI。
这里我也必须诚实的坦白一件事,虽然我的方法确实可以不花一分钱,但我自己是花了19块8的。
3.9 钱花在哪了?
为了生歌我测试过好几个平台。国外的就不说了,有点水土不服,民谣、国风、流行不如国内平台。国内我深度测试过两个平台,一个是天谱乐,一个是Melo,可以说和海绵音乐不分伯仲(甚至Melo的可控性更高),免费却额度有限(极其有限),都是一次生两个结果每日体验积分分分钟就用完了,当然用来作为最后统一整体效果的步骤也是可用的。
另一个算是我踩过的坑。我搜到一个叫"天工音乐"的平台,当然我是冲"天工"去的,结果是浙江的一家电商公司套了天工的壳,打着"19块8终身VIP"的旗号,这玩意谁忍得住?不开会员你不但要排队还有试用限制,开了会员确实取消了限制,但依然要排队,而这个排队不是等着生,而是排到你才轮得到你生成,每天几(一)首歌之后就会跳出提示框提醒你买加速包免排队。效果嘛,咋说呢,也不是不行,都是抽卡谁不比谁强多少,但问题是不可控,风格和男女选项跟摆设一样(写文案时还有,排版时再看性别选项都没了),肯定是不推荐的。
零成本工具速查
豆包AI生歌:生成旋律片段。分段生成,换风格试错,挑出满意旋律。免费。
剪映:拼接片段,对齐节拍。纯体力活。免费。
海绵音乐:翻唱或重制,统一音色,调整伴奏。免费版可用。
歌有了,它可能不完美,但这是0到1有到无的跨越,这个跨越本身比歌曲好坏更重要。
知道为什么我的标题用圆一个你不敢做的梦了吗?以前图好不好、文好不好我们都可以厚着脸皮评论几句,因为只要就受过九年制义务教育你就上过美术课、语文课,画过画、写过作文,唯有音乐,我们在音乐课上只唱过歌,面对音乐大部分人都会非常有自知之明的闭嘴。
但今天不一样了。
歌曲本身好不好已经不重要了,重要的是你的词已经被唱出来了,是个玩意了,它活过来了,从纸面站了起来开始有自己的呼吸了。
下一章,我们让AI把这个声音变成画面——让你记忆里,那天下午光影中的那个他、她、它也活过来。