NarratoAI开源影视解说工具(GitHub 10.8k星),输入视频或主题,AI自动写解说文案、剪辑、配音、加字幕一条龙出片,剪映式时间线还能手动精修,支持导出剪映草稿。本地部署免费无限量,底层可接硅基流动、智谱等免费API实现全程零成本,零基础也能搭自己的ai一键生成影视解说流水线👇
免费AI 智能生成工具:NarratoAI开源影视解说,文案剪辑配音字幕一条龙
📖 简介
NarratoAI 是一站式 AI 影视解说 + 自动化剪辑工具,GitHub 上 10.8k 星、MIT 协议开源。它的定位很直接,把「写解说文案、剪画面、配音、加字幕」这四件事串成一条自动化流水线,你丢进去一个视频或一个主题,它自己产出解说成片。v0.8.6 版本 2026 年 7 月刚发布,更新节奏按月算。
它脱胎于开源的 MoneyPrinter 项目,但重点做了影视解说方向,支持纪录片逐帧分析、短剧解说、短剧混剪,还能一键导出剪映草稿继续精修。和之前写过的云端工具 VibeKnow(网页上传即出片)不同,NarratoAI 主打本地部署,素材和成片都在自己机器上,不按条数收费。
🟢 上手难度:★★★☆☆
比纯网页工具多一步配置,但没有想象中高。官方给的推荐路径是整合包,Windows 下载 x64 整合包解压,先双击 update-windows.bat 更新,再双击 start.bat 启动,浏览器打开 http://127.0.0.1:8501 就是 WebUI。macOS(Apple Silicon)同样有整合包,首次打开被系统拦截时在终端执行 xattr -cr 即可。会 Docker 的话 docker compose up -d 一条命令也能起。
硬件要求很友好,最低 4 核 CPU + 8G 内存,显卡非必需(官方 README 明确写了)。需要自己动手的是配置模型 API,复制 config.example.toml 为 config.toml,填文本模型和视觉模型的 Key。好在默认配置直接指向硅基流动(OpenAI 兼容接口),模型预填了智谱 GLM-5 和通义 Qwen3.5,Key 填进去就能跑。
💰 收费规则
软件本体免费开源(MIT),本地部署没有任何按量费用、没有会员墙、不限制生成条数。唯一的成本是底层模型 API 调用费,而这一块也可以压到接近零: - 文本/视觉模型:默认硅基流动,注册送 2000 万免费 token(README 官方福利,约 16 元平台配额),官方口径剪辑 10 分钟视频约 0.1 元;也可以接智谱 GLM-4-Flash 这类永久免费接口 - 配音:豆包 TTS、通义 qwen3-tts-flash 都有免费额度;想零成本可以本地部署 IndexTTS/CosyVoice 开源模型 - 字幕转录:阿里百炼 Fun-ASR 有免费额度
也就是说,用免费 API 组合可以做到全程零成本出片,这也是它和付费解说工具最大的区别。
✅ 上手体验(基于 v0.8.6 源码审查与官方文档整理)
我在服务器上 clone 了源码逐项核对(仓库结构、配置文件、模块划分都过了一遍),结合官方文档把完整流程走通一遍:
第一步:装好环境。 整合包最省事;源码跑法也简单,uv sync 装依赖、cp config.example.toml config.toml、uv run streamlit run webui.py 启动,浏览器开 http://localhost:8501。源码里 webui.py(28KB)是 Streamlit 入口,功能模块都在 app/ 和 webui/ 下,测试覆盖了文案生成、纪录片逐帧分析、AI 配乐等核心链路,代码质量是认真维护的水平。
第二步:填 API Key。 文本模型负责剧情分析和文案生成,视觉模型负责理解画面内容(默认 Qwen3.5-122B-A10B,走硅基流动)。配置文件里各家供应商的注释写得很全,DeepSeek、阿里百炼、OpenAI 兼容接口随便换。
第三步:跑四步流水线。 WebUI 里上传视频素材(或直接给主题),流水线依次执行四步,写文案(LLM 生成解说稿,纪录片模式会先逐帧分析画面)→ 自动剪辑(按文案节奏切画面、挑高光,支持短剧混剪和一键合并素材)→ 配音(豆包 TTS / 通义 qwen3-tts-flash / CosyVoice2,v0.8.6 还加了 IndexTTS 语音克隆,几秒参考音频就能复刻音色)→ 加字幕(Fun-ASR 一键转录,字幕翻译、校准都有)。剪完的结果是剪映式时间线,能手动拖拽精修,不满意的地方直接改。
第四步:导出。 支持直接导出剪映草稿,丢进剪映继续做包装;也可以直接出成片。v0.8.6 还新增了可选的 Sonilo AI 配乐,根据画面内容和剪辑节奏自动生成背景音乐,最长支持 6 分钟视频。
说句实话,受服务器环境限制,这次没有实际跑完一整条视频成片(需要配 Key + 本地媒体环境),以上流程均来自源码与官方文档逐项核对。但光从工程结构看,这套「文案→剪辑→配音→字幕」的流水线是完整打通的,社区 10.8k 星也说明跑通的人不少。
👤 适合人群
• 影视解说/短剧混剪 UP 主:量产解说视频,剪映草稿导出后人工精修,效率翻倍
• 想做解说号但没预算的新手:免费 API 组合零成本起步,先跑通再考虑付费模型
• 在乎数据隐私的自部署党:素材、成片、API Key 全在自己机器上
• 昨天领了免费 API 的朋友:智谱、硅基流动的免费额度正好在这里派上用场
不太适合完全不想碰配置文件、只想网页上传就出片的人,这种场景用云端版 VibeKnow 更省事。
🔗 链接
GitHub 仓库: https://github.com/linyqh/NarratoAI整合包下载: https://cutagent.online/官方文档: https://p9mf6rjv3c.feishu.cn/wiki/SP8swLLZki5WRWkhuFvc2CyInDg
🤖 AI资讯
• 工具动态 — 小米FireRed团队开源FireRedTTS3:多语种多方言语音克隆+指令式音色设计,几秒参考音频克隆人声,配音赛道新选手 🔗 https://github.com/FireRedTeam/FireRedTTS3 • 模型发布 — 阿里发布Qwen-UI-Agent:以真实世界为中心的GUI智能体基座模型,覆盖移动端、电脑端、网页端及深度搜索,模型可直接操作界面完成任务 • 行业新闻 — OpenAI CFO在全员大会表示公司最迟2027年上市,6月已秘密提交IPO招股书;本季度整体年化营收增长35%,企业级业务年化增长50% • 产品发布 — Anthropic宣布Claude Platform的Computer Use、Skills API与Files API全面可用,智能体可操作软件、调用团队技能并返回成品文件 • 产品发布 — Mistral推出Agentic Search:通过search、open、navigate、read、grep五工具的多步检索循环,提升复杂文档查询准确率 • 行业新闻 — 日经报道:受AI投资推动,中国科技大企业加速业务优化,游戏和零售行业正迎来重组浪潮 • 模型发布 — HuggingFace开源LFM2.5系列DSpark草稿模型:投机解码让GPU吞吐最高提升3.18倍,仅约300M参数,支持llama.cpp和SGLang
💡 今天就到这,周末愉快!明天同一时间,继续实测免费AI创作工具,点个关注不错过
还没关注的朋友点个关注👇 每周获取最新AI工具实测与开源项目推荐,告别信息差
关注「赛博上片指南」,每周最新AI工具实测+开源项目推荐,告别信息差
🎬 视频生成 | 🎨 设计工具 | ✍️ AI写作
🔗 AI创作工具导航页,回复「工具」获取
觉得有用点个在看👇 你用过最好用的AI工具是哪个?评论区聊聊~
建议收藏🌟 以后慢慢看~
夜雨聆风