这两周做了两个工具,一个是全平台内容自动发布工具,一个是口播数字人。
为什么做内容自动发布系统?
因为我发现,写出文章做好视频后,想把这些内容稳定地发布到不同的平台,这事看上去不复杂,但非常消耗人。
一两个还好,一旦多了,很多精力就被这些重复动作吃掉了。
关键这些事情没有多少创造性,但又必须有人做。
所以索性花点时间把这个自动发布工具做出来。
这个工具第一阶段的功能基本实现,就是把文章或视频放到指定文件夹,启动之后就能自动打开如公众号、头条号、知乎、B站、视频号、小红书等平台发布出去,标题和介绍什么的也能自动填写。
当然,现在它还不算一个很完善的产品,更像是我给自己做的一个工作助手。
但它至少先解决了我自己的一个问题:以后做内容,不用把那么多时间耗在重复发布上。
至于第二阶段的功能,我想过,这玩意其实是可以根据设定好的方向自动找选题、写文章、再自动发布。
理论上,它甚至可以 24 小时不停地运行,根本不需要人亲自去写。
目前就是先把接口留好,方便以后拓展。
另一个让我很感兴趣的,是口播数字人。
刚开始接触的时候,我觉得这东西挺神奇的。
但真正自己做了一遍,又感觉它也没有那么玄乎。
拆开来看,大概就是几个步骤:
提取和改写文案,克隆声音,生成视频,再做标题和封面。
其中最关键的,还是视频生成。
它的核心逻辑,是用音频去驱动人物嘴型变化。
所以,要做这个口播数字人,需要上传一段自己的自拍视频。
视频里具体讲什么并不重要,重点是让系统学到人物的形象、嘴型和说话状态。
后面输入一段文案,配上克隆好的声音,就可以生成一条口播视频。
大部分情况下,生成效果已经比较接近真人实拍。
至少对于日常知识分享、工具介绍、观点表达这类内容来说,已经够用了。

当然,数字人还不止这一种形式。还有升级版的,升级版不需要提前录一段视频,直接用一张图片生成口播视频。
它不只是驱动嘴型,人物的表情、神态和动作,也可以一起生成。
但对电脑配置和生成能力的要求也更高。
我现在还没有正式去尝试。
不过从趋势来看,数字人的能力肯定会越来越强,制作成本也会越来越低。
以后一个人做内容,可能真的不一定非要天天出镜、天天拍视频。
以上这个视频就是用AI口播数字人工具出的,不细看应该看不出什么问题吧。不过发给朋友们,都说能看出AI的痕迹。
AI 时代变化太快,没有人能准确预测哪个项目一定成。与其等一个完美答案,不如持续做一些感兴趣的小实验。
自动发布、数字人、内容创作,看上去是不同方向,但它们都在积累同一种东西:
对内容的理解 对用户需求的理解 对 AI 工具的驾驭能力 可复用的工作流 属于自己的渠道和影响力
今天没跑通的项目,也许会成为三个月后某个项目最关键的一块拼图。
我现在也不知道数字人项目最终会走到哪里,自动发布系统能发展成什么样。
但AI 时代,不尝试的人,很难有自己的答案。
不一定每一拳都能打中要点,但只要方向大致是对的,每一次出拳都不会白费。
先做出来,先跑起来。机会,往往不是等来的,而是在不断行动里慢慢显出来的。
夜雨聆风