
你有没有这种经历:
刷到一个很干的 AI 教程视频,收藏了,想着以后慢慢看。结果真到要用的时候,翻出来,又得从头看一遍,找那个关键知识点...
10 分钟的视频,找 2 分钟的重点,花了 15 分钟。
最近我在系统学习 AI 视频生成,刷了大量教程视频,实在受不了这种低效的学习方式。
于是我做了一个工具:视频知识提取 Skill。

先说明白:这是什么?
这是我给豆包桌面端做的一个 Skill(技能插件)。
简单说:给它一个视频,它帮你整理成一份结构化的知识文档。
⚠️ 先讲清楚限制:
目前只在豆包桌面端使用,其他 AI 平台(ChatGPT、Claude 等)用不了 语音转写用的是飞书妙记(需要你有飞书账号) 关键帧提取用 ffmpeg,这个是通用的 整体是「豆包 + 飞书」生态的工具,跨平台兼容性一般
它能做什么?
具体来说,它会做这几件事:
1️⃣ 语音转写(飞书妙记)
自动把视频里的语音转成文字,带时间轴。用的是飞书妙记的能力,准确率还不错。(需要你有飞书账号,并且登录了 lark-cli)
2️⃣ 关键帧提取(ffmpeg)
自动抽取视频里的关键画面。PPT 页面、操作界面、示意图... 都帮你截好了。这个是通用的,不依赖飞书。
3️⃣ 结构化文档生成
根据视频类型,自动选择合适的模板,生成一份 Markdown 文档。
目前支持 6 种模板:
- AI 方法论:技巧分享、经验总结
- 操作教程:手把手教学
- 产品演示:功能介绍、发布会
- 演讲分享:讲座、访谈
- 新闻资讯:事件报道
- 通用模板:不确定类型就用这个
4️⃣ 知识补充(可选)
觉得视频内容不够全面?它还能帮你搜索补充相关知识,生成参考资料列表。
实际效果怎么样?
我用它处理了几个 AI 视频教程:
输入:一个 10 分钟的「AI 视频配音技巧」
视频输出:
完整逐字稿 + 时间轴 20 张+关键帧截图 一份结构化的方法论文档 核心痛点 3 个配音技巧 实操步骤 避坑指南 工具推荐
整个过程,我只需要点一下「开始」。
剩下的整理、提炼、排版,都由 AI 来做。

谁适合用?
- 豆包用户:已经在用豆包桌面端,想提升效率
- AI 从业者:刷教程、学新技术,快速整理知识点
- 产品经理:看产品演示、行业分享,快速提炼要点
- 设计师:看设计教程、灵感视频,收集方法论
(前提:你用豆包,并且有飞书账号)
怎么获取?
这个工具是我基于豆包桌面端做的 Skill,完全开源,免费使用。
安装方式:
1. 打开豆包桌面端,复制以下提示词发给豆包()
请在豆包桌面端安装这个视频知识提取 Skill:https://github.com/zhongwentuo-creator/doubao-video-knowledge-extractor(仅支持豆包桌面端)
写在最后
做这个工具的初衷很简单:让学习效率更高一点。
我们每天刷那么多视频,真正沉淀下来的知识有多少?如果能把视频里的精华快速提取出来,整理成可以检索、可以复习的文档,学习效率至少能提升 3 倍。
当然,它不是万能的:
只支持豆包桌面端 语音转写依赖飞书 还在早期版本,可能有 bug
但对我来说,已经够用了。如果你也是豆包 + 飞书的用户,不妨试试。
这是 v0.3 版本,功能还在持续迭代中。如果你有什么想法或建议,欢迎在评论区告诉我。
觉得有用的话,点个「在看」,分享给更多爱学习的朋友~
夜雨聆风