夜雨聆风学习资料网

ARTICLE · 1103796

AI数字人短视频+免费工具+保姆级教程:0基础半小时做出第一条会说话的口播视频

AI数字人短视频+免费工具+保姆级教程:0基础半小时做出第一条会说话的口播视频
             AI数字人短视频+免费工具+保姆级教程:0基础半小时做出第一条会说话的口播视频           

你有没有刷到过这样的视频:一个人对着镜头讲了一分多钟,条理清楚、不卡壳、背景还挺好看。你以为这是哪个博主,其实画面里那个人根本不是真人——他连一次都没坐到镜头前。

这就是数字人视频。

今天我们就亲手做一条:写一段稿子,让屏幕里的"人"替你说出来。

先交个底:

  • 今天做成什么样:
    一条 30 秒左右的竖屏口播视频,画面里有个人,在讲你自己写的稿子
  • 要多久:
    第一次大概 30 分钟,做熟之后十几分钟
  • 要花钱吗:
    写稿的 AI 免费;数字人功能有免费额度,做一条 30 秒的练习视频够用,超了才需要付费
  • 能靠它赚钱吗:
    能,但先说实话——这类视频接单单价不高,靠的是量。真实行情放在文末

一、先搞明白:数字人视频到底是什么

别被"数字人"这三个字吓到。它就是三样东西拼起来的:

三样东西
说白了是什么
谁来给你
一张脸
屏幕上那个"人"
工具自带,你选一个就行
一个嗓子
念稿子的声音
工具自带,你选一个音色
一段话
你要讲的内容
你自己写,这是唯一要动脑的地方

工具会自动让那张脸对着你的稿子动嘴,这一步叫"对口型"。

所以你真正要做的事,只有一件:把那段话写出来。 其他都是点几下按钮的事。

还有一个概念你懂一句话就够了:30 秒的口播稿,大概是 100 到 130 个字。写多了念不完,写少了画面空。记住这个数字,后面写稿你就知道该写多长。


二、准备(免费,五分钟)

1. 一个能写字的 AI:豆包、通义千问、DeepSeek、Kimi 任选一个,网页版或 App 都行

2. 一个带数字人功能的视频工具:剪映(手机 App 或电脑版)里的「数字人」、即梦 AI、腾讯智影,任选一个用熟

3. 一部手机或一台电脑:装得上上面那个工具就行

提醒:不需要相机,不需要麦克风,不需要你会剪辑,也不需要露脸。全程你都不用出现在镜头里。

不同版本的入口位置不一样,找不到就在工具里搜「数字人」三个字,一般都能搜到。


三、动手做:五步做出你的第一条
第一步:先写一段 30 秒的口播稿(最关键)

先在纸上写三行:

1. 说给谁听:想下班后搞点副业、又怕被割的人

2. 解决什么问题:不知道第一步该干什么

3. 听完记住哪一句:先把免费工具用熟,再谈赚钱

然后把下面这段整段复制进 AI:

         你是短视频编导。请帮我写一段 30 秒的口播稿,主题是「做副业第一步该干什么」,要求:        

>

         1. 全中文简体,口语化,像跟朋友面对面聊天,不要书面语;        
         2. 第一句就要让人停下,不要「大家好我是谁」这种开场;        
         3. 全篇只讲一个重点,不要讲三件事;        
         4. 总字数 100 到 130 字,大概 30 秒能念完;        
         5. 分成 6 到 8 句短句,每句不超过 20 字,方便做字幕;        
         6. 结尾落在「你自己去动手」,不要喊「关注我」「点赞」;        
         7. 直接把稿子给我,不要解释,不要写标题。        

按回车,等它写完。你会得到一段大概 120 字的稿子,长这样:

真实成品:上面那段提示词生成出来的口播稿,118 字,分成 6 句短句,念一遍刚好 30 秒出头

拿到稿子一定要念出声念一遍。 拗口的地方直接改成你自己的说法,别留着。

第二步:把稿子改得像"人话"(可选,但很值)

AI 写的稿子有两个通病:形容词太多、句子太工整。

去 AI 味就三招:

1. 删形容词 —— "非常实用"改成"能省一半时间"

2. 加一个具体数字 —— 别写"很多人",写"我身边三个人"

3. 出声念一遍 —— 哪句念着别扭,就用你自己的话重说一遍

第三步:打开工具,挑一个数字人形象

打开剪映(或即梦 AI、腾讯智影),找到「数字人」,里面会给你一排形象让你挑。

挑的时候记住三条:正脸朝镜头、光线均匀、背景干净。别挑侧脸的、别挑半身太远的、别挑戴墨镜的。

下面这张,就是我按上面那段话的思路生成出来的一张数字人形象:

真实成品:AI 生成的一版数字人形象——正脸、光线均匀、背景干净,这种最适合拿去做口播

如果工具里自带的形象都不满意,可以自己拍一张正脸照片上传,或者用 AI 生成一张再传上去。但只能用你自己的照片,或者明确拿到授权的照片,这条红线后面还会讲。

第四步:粘贴稿子,选音色,点生成

1. 把第一步那段稿子整段粘贴进工具的文本框

2. 选音色:女声、男声随你,语速调慢一点(0.9 到 1.0 倍,快语速听着像念稿)

3. 点「生成」或「合成」,等几分钟(有的工具要等十几分钟)

4. 生成完先听一遍,哪里念错了就改稿子重新生成

免费额度是有上限的,所以第一次别写长稿,就做 30 秒。跑通了再谈加长。

第五步:加字幕、导出、发出去

1. 大多数工具会自动出字幕;没有的话,用剪映的「识别字幕」功能,一键就出

2. 字幕调成一屏一行、字号大、白字黑边,这是手机上最耐看的字幕样式

3. 导出选竖屏 9:16、1080P,这是短视频平台的通用尺寸

下面这张,就是把上面那张形象 + 字幕条拼出来的成片画面(这是我用同一套素材叠出来的示例,真实的成片里那个人是会动、会张嘴的):

真实成品:一条成片的画面——上面是数字人形象,顶部是栏目标签,底部是字幕条,字幕文案就是第一步那段稿子的最后一句

到这一步,你就有一条能发出去的视频了。 画面里那个人,一句话都不是你自己说的。


四、想换内容?换稿子就行

这套方法最值钱的地方不是这条视频,而是同一个形象可以讲任何东西:

你想做的号
稿子换成
卖水果的店
今天的车厘子到了,怎么挑怎么存
教做菜的
一道三分钟家常菜,几步说完
讲养生的
换季这几天,老人该注意什么
房产中介
这套房为什么挂了半年没卖掉
讲副业的
三个免费工具,先把它们用熟
你自己的知识
你干这行最想吐槽的一件小事

换一个主题,改一次稿子,二十分钟就是一条新视频。 这就是为什么这东西能接单——同一个流程,换内容就是新产品。


五、常见卡点自救表
你遇到的情况
原因
怎么办
找不到「数字人」入口
版本不同,位置不一样
在工具里搜「数字人」,或更新到最新版
生成出来嘴型不对
稿子里有生僻词、英文缩写
把生僻词改成口语说法,重生成
念出来的语气很平
音色没选好、语速太快
换个音色,语速调到 0.9 倍
形象看着像假人
选的形象太远、光线差
换成半身、正脸、光线均匀的形象
稿子太长,念不完
超过 130 字了
砍到只讲一个重点,删掉第二第三件事
字幕一屏好几行
句子太长
回去把长句拆成两句,重出字幕
生成到一半失败
免费额度排队
等一会儿再点,或换个时间段
导出后发出去很糊
导出分辨率太低
导出时选 1080P,别选 720P
免费额度用完了
额度有限
换个工具试,或隔天额度恢复再做

六、说实话:这东西能拿去干嘛?

1. 自己的号 —— 你不想露脸、不想化妆、不想收拾屋子,那就让数字人替你说

2. 本地小店 —— 店主不敢出镜,用数字人念店里的活动,比一张图有说服力

3. 知识类账号 —— 你手上本来就有文字(文章、笔记、课件),改成口播稿就是一条视频

4. 当成接活的第一单 —— 你手上有一条真做出来的视频,比"我会做短视频"这句话有用得多

给几句实话:

  • 一条这样的口播视频,行情大概几十到两三百块
    ,看你要不要帮客户写稿、要不要加字幕、要不要改到满意
  • 别按"拍视频"报价
     —— 你说"拍视频"客户想到的是请人扛机器来家里,你说"帮你做一条口播"客户才听得懂
  • 别信"数字人月入过万"
     —— 一条几十块,一个月能接十来条就很勤快了
  • 先收一半定金再动手
    ,改到满意收尾款;不给定金、只要一份样片的,多半拿片就消失

七、四条红线,千万别碰
  • 别用别人的脸做数字人形象
     —— 用真人照片、用明星的脸,都涉及肖像权,出事赔不起
  • 别做"AI 换脸"
     —— 把别人的脸套到别的视频上,这是明确违规的
  • 别用数字人冒充真人身份做背书
     —— 医疗、法律、金融这类内容,数字人加上"专业身份"就是误导
  • 发的时候标一句"画面由 AI 生成"
     —— 平台基本都要求标注,别藏着

         今天你的任务只有一件:打开一个免费工具,写下那三行交底,让 AI 出一段 120 字的稿子,然后挑一个形象,把它生成出来。        

>

         哪怕只有 30 秒、只有一句话、只有一个人站在那里念完,只要你真的导出过一条视频,你就已经跨过了一道很多人一辈子都没跨过的坎——画面里那个人,替你说出了你自己写的话。        

>

         别贪多,也别想着一次做完美。先做出来,你自己去动手。        
🌟 关注公众号【AI副业与面包】
专注分享 AI 大模型落地、副业技能变现实战与高效工具,与你一同探索智能化未来!
     
长按识别上方二维码,或在微信搜一搜【AI副业与面包】关注

相关学习资料