ARTICLE · 1114311
AI有声书+AI配音+免费工具+保姆级教程:0基础30分钟把一篇文章变成能听的音频
很多人手机里都装着听书软件:通勤路上听小说、睡前听故事、干活的时候听点东西。
你有没有想过——你自己也能做一本有声书。不用录音棚,不用买话筒,不用请人配音,甚至不用你自己开口念。
你只要有一篇文字,加上一个免费工具,就能把它变成一段能听的音频。
今天我们就亲手做一章出来。
先交个底:
- 今天做成什么样:
一章完整的有声书音频(有人声朗读、有背景音乐),能导出成 mp3,能发能听 - 要多久:
第一次大概 30 分钟出一章,做熟之后十几分钟 - 要花钱吗:
朗读功能免费,剪映免费,做一章练习完全够用,超长内容才要考虑付费 - 能靠它赚钱吗:
能,但先说实话——音频这类东西单价不高,靠的是数量和长期更新。真实行情放在文末
别把它想复杂。一本有声书,说白了就是三样东西拼起来:
| 你自己写,或用版权过期的公版内容 | ||
这里有一个概念,你懂一句话就够了:TTS。
TTS 就是"文本转语音",说白了——你把字打进去,它替你把这段话念出来。念出来的早就不是机器人那种电子音了,现在的中文音色很自然,有男声、女声、温柔声、讲故事的声音,你挑一个顺耳的就行。
还有一个数字你记住就够:中文朗读一分钟大概 250 个字。所以你写 2000 字,念出来差不多就是 8 分钟。一章写 2000 到 3000 字,做起来轻松,听起来也不累。
新手最容易翻车的地方只有一个:多音字。 比如"行"(xíng / háng)、"重"(zhòng / chóng)、"了"(le / liǎo)。机器不认识上下文就会念错。这个后面第三步教你怎么治它。
1. 一个能朗读的工具:剪映(手机和电脑都有,自带"文本朗读")、豆包 App、通义 App,任选一个
2. 一个能剪音频的工具:剪映就够,朗读和剪辑在一个软件里,不用来回导
3. 一段你自己的稿子:原创的文字,或者版权已经过期的老故事
提醒:不用买话筒,不用会配音,不用会剪辑。全程你只做两件事——粘贴文字 + 点按钮。
不同工具入口位置不一样,找不到就在工具里搜「朗读」或者「配音」两个字,一般都能搜到。
先在纸上写三行:
1. 讲给谁听:睡前想听点东西的人
2. 讲的是什么:一只小面包收到远方朋友的一封信
3. 大概多长:一章 2000 字左右
然后把下面这段整段复制进 AI(豆包、通义、DeepSeek 都行):
你是儿童文学作者。请帮我写一章睡前故事,讲给大人听,主题是「一只小面包收到远方朋友的一封信」。要求:
>
1. 全中文简体,语言口语、温和,句子要短;
2. 分成 4 到 6 段,每段 200 到 300 字,一共 2000 字左右;
3. 不要生僻字,不要吓人的情节,结尾温暖;
4. 只写故事本身,不要标题,不要解释,不要写"第几段"。
按回车,等它写完。拿到之后自己念一遍,哪句拗口就改成你平时说话的样子,别留着。
这一步的关键:别用别人的小说。 后面第七节会专门讲版权,这是做音频最容易踩的坑。
不要整篇一次性丢进去。按段落切,一段 200 到 300 字。
为什么要切?两个原因:
1. 一次文字太长,朗读功能容易中途断掉或者卡住
2. 哪一段念错了,你只重做那一段,不用整篇重来
切完顺手处理两件事:
- 数字改成汉字:
把 "2026" 改成 "二零二六",把 "3" 改成 "三"。机器念数字容易念成"三点零" - 多音字标一下:
拿不准的,直接在字后面加个括号写拼音,或者干脆换成另一个同音字
打开剪映,新建一个项目:
1. 点顶部的「文本」,选「新建文本」(有的版本叫「默认文本」),把第一段粘进去
2. 选中这个文本框,在右边找到「朗读」(有的版本叫「文本朗读」),点它
3. 挑一个音色:想温柔就选女声里的"温柔",想要讲故事的感觉就选"故事"类的
4. 语速先调到 1.0 倍(慢了拖沓,快了听不清)
5. 点「开始朗读」,等几秒,音频就生成好了
生成完,把这段音频留着,接着做下一段。
一章切了 8 段,就是重复 8 次。 不满意就删掉重来,反正免费。
现在你手上有好几段音频了,要把它们拼成一章:
1. 在剪映里,把这几段音频按顺序拖到同一条音轨上,首尾接起来
2. 点「音频」→「音乐素材」,搜一个"舒缓"或者"安静"的背景音乐,加进来
3. 选中这段背景音乐,把音量拖到 20% 左右(重点:背景乐只做背景,绝对不能盖过人声)
4. 给背景乐的开头和结尾各加一个「淡入」「淡出」(选中音频 → 淡化)
5. 点右上角「导出」,格式选音频,码率选 128kbps
到这一步,你就有一章完整的、带背景音乐的有声书音频了。
下面这张,就是用这套思路真做出来的一章成品封面:

真实成品:AI 生成的有声书封面(底图由 AI 绘制、书名由工具叠加)——你的第一章也要配一张这样的封面
而下面这张,是上面那段稿子真的被朗读出来之后的音频波形(用电脑里的朗读功能生成的真实音频,不是画出来的):

真实成品:一段真实生成的朗读音频的波形图,上面标着章节名和时长——你可以照着做一个自己的
1. 导出的音频是一个 mp3 文件,可以直接发微信、发朋友圈
2. 要长期更新:去喜马拉雅、番茄畅听这类平台,按"专辑"发布,一章一条
3. 要发公众号:公众号可以直接插入音频,读者在文章里就能听
别急着一次做十章。 先把一章做完整,再去想第二篇。
这套方法最值钱的地方不是这一章,而是同一个流程,换一份稿子就是一档新节目:
换一个主题,换一份稿子,重新生成一遍,就是一档新节目。 这就是它能长期做下去的原因。
1. 给自己的公众号/视频号做音频 —— 把文章念成音频,多一种内容形式
2. 给长辈、孩子做故事音频 —— 自己写的故事,念出来给他们听
3. 接朗读、配音的活 —— 有人需要把文字做成音频,你帮他做
4. 企业培训音频 —— 把员工手册、产品说明做成能听的版本
5. 做一档自己的音频节目 —— 长期更新,慢慢积累听众
给几句实话:
- 一条朗读音频,行情大概几元到几十元
,看长度、看要不要配背景音乐 - 别按"配音演员"报价
—— 你说"配音",客户想到的是专业播音员;你说"把这段文字做成音频",客户才听得懂 - 别信"AI 有声书月入过万"
—— 一条几块几十块,一个月能接几十条就很勤快了 - 先收一半定金再动手
,先交一版样音让对方听,满意再收尾款
- 别把别人的小说、畅销书录成音频上架
—— 没有授权就是侵权,这是音频领域最常见的雷 - 别盗用别人的配音和音频
—— 别人的音色、别人的成品,都不能拿来用 - 别冒充真人朗读
—— 发的时候标一句"音频由 AI 朗读生成",别装成是你自己念的 - 要商用先看清平台规则
—— 平台对 AI 音频有标注要求,也有类目限制,上架前先读一遍规则
今天你的任务只有一件:写下那三行交底,让 AI 写一段 2000 字的稿子,切出一段丢进剪映,点一次「朗读」,把它导出成 mp3。
>
哪怕只有 30 秒、只有一段、只有一句话被念出来,只要你真的生成了一个能听的音频文件,你就已经跨过了一道很多人一辈子都没跨过的坎——你亲手做出了一集有声书。
>
别贪多,也别想着一次做到完美。先做出来,你自己去动手。