ARTICLE · 1136823
腾讯开源AI漫剧工具:一条命令生成视频
腾讯开源 WorkRally:面向 AI Agent 的漫剧视频创作全流程工具集,支持生图、生视频、生音频、提示词优化、无限画布和项目管理,30+核心能力一条命令搞定,6 种视频生成模式,资产库管理角色一致性,还能让 AI Agent 自动帮你做漫剧。
腾讯又出手了
最近刷 GitHub,发现腾讯开源了一个新东西——WorkRally。
第一眼看到,我以为又是一个普通的 AI 绘图工具。
点进去一看,嚯,来头不小。这不是一个简单的生图工具,而是一整套 AI 漫剧视频创作的 CLI 工具集。
什么意思呢?就是你在命令行里敲几条命令,就能完成从项目创建、角色设定、生图、生视频、配音频到最终成片的全流程。
而且它是专门为 AI Agent 设计的,可以被 Codex、Claude Code 这些 AI 编程助手直接调用,让 AI 帮你自动做漫剧。
147 颗星,MIT-0 协议,完全免费商用。
今天就带大家盘一盘这个工具,看看它到底能干嘛,以及怎么上手。
WorkRally 是什么
先一句话说清楚:
WorkRally 是腾讯开源的、面向 AI Agent 的 AIGC 漫剧视频创作全流程工具集。
它的背后是腾讯的 WorkRally 平台(workrally.qq.com),这个 CLI 工具把平台的 30 多项核心能力封装成了命令行指令。
你可以把它理解为:
一个命令行版的漫剧创作工作台 一个AI Agent 可以直接操作的创作工具 一条从文字到视频的自动化流水线
跟市面上那些「一句话生成视频」的工具不一样,WorkRally 走的是工业化生产路线。
它不是给你一个输入框让你瞎碰运气,而是提供了完整的项目管理、资产库、场次管理等专业功能。
简单说,它更像是给专业创作者和团队用的生产工具,而不是玩具。
六大核心能力

WorkRally 的功能很全,我挑最核心的六个给大家讲讲。
AI 生图:多参考图 + 高质量
生图是漫剧创作的基础。WorkRally 的生图能力基于 Kontext 模型,支持多参考图输入。
什么概念呢?你可以上传角色设定图、场景参考图,然后让 AI 按照你的描述生成新的画面,同时保持角色和风格的一致性。
分辨率支持 1080P、1440P 甚至 2160P,质量档位可选 high 或 standard。
如果你用过 Midjourney,它还支持传 Midjourney 的扩展参数,比如 stylize 之类的。
AI 生视频:6 种驱动模式
这是 WorkRally 最厉害的地方之一——视频生成有 6 种模式。
不是那种只有「文生视频」一种模式的玩具,而是覆盖了专业创作的各种场景:
- Text 模式
:纯文字生成视频 - 图生视频
:文字 + 参考图,让画面动起来 - 首尾帧模式
:给第一张和最后一张图,AI 补中间的动画 - 参考主体模式
:给角色参考图,控制角色一致性 - 视频编辑模式
:基于已有视频修改 - 智能编辑 / 视频延长
:把短视频变长,或者智能剪辑
每一种模式都对应不同的创作需求。
比如做漫剧,你可能先用「首尾帧模式」做出关键镜头,再用「视频延长」把镜头拉长,最后用「智能编辑」调整细节。
而且默认自带音效,不用后期单独配。
AI 生音频:音效 + 音乐
漫剧光有画面还不够,声音也很重要。
WorkRally 内置了音频生成能力,分两种:
- 音效生成
:比如雨声、脚步声、打斗声 - 音乐生成
:支持输入歌词,生成带人声的歌曲
音色模型有多种可选,MiniMax 的音频模型也支持。
这样一来,画面+声音一条龙,不用再去找别的工具配音效了。
提示词优化:让 AI 帮你写提示词
很多人做 AI 视频最大的痛点是:提示词写不好。
同样的内容,提示词写得好和写得差,出来的效果天差地别。
WorkRally 有个「提示词优化」功能,你把粗糙的描述丢进去,它会帮你优化成专业的视频生成提示词。
还支持上传参考视频、参考图片、参考音频,AI 会综合这些素材来优化提示词。
对于新手来说,这个功能非常实用。
无限画布:可视化创作
除了命令行操作,WorkRally 还支持无限画布。
这个画布是基于 Yjs 协同编辑技术做的,支持 8 种节点类型,可以实时同步。
什么意思呢?就是你可以在画布上拖拽节点、排列分镜、管理素材,就像在 Figma 里做设计一样。
而且 AI Agent 也可以操作这个画布——你让 AI 帮你生成一张图,它会自动在画布上创建占位节点,生成完直接显示在画布上。
项目 & 资产库:工业化管理
这是 WorkRally 跟其他工具最大的区别:它有完整的项目管理体系。
不是一张一张图地生成,而是按「项目→剧集→场次」的层级来组织:
- 项目
:一部漫剧就是一个项目 - 剧集
:项目下面分多集 - 场次
:每一集由多个场次(镜头)组成
每个场次都有独立的图片生成线、视频生成线、音频生成线。
还有资产库,树形管理人物、道具、场景素材,你可以把角色设定存进去,做的时候直接调用,保证全片角色一致。
这个架构,完全是工业级漫剧生产的标准配置。
快速上手

讲了这么多,怎么上手呢?
其实很简单,WorkRally 是一个 npm 包,一条命令就能安装。
安装
全局安装 CLI
npm install -g workrally配置登录
安装完之后,需要配置 API Key。
API Key 可以在 WorkRally 官网(workrally.qq.com)的开放平台申请。
Agent / 服务器使用(推荐)
workrally auth login --token <YOUR_API_KEY>或者用环境变量:
export WORKRALLY_API_KEY=<YOUR_API_KEY>本地个人使用
workrally auth login这个命令会自动打开浏览器,走 OAuth 登录流程,适合在自己电脑上用。
登录成功后,验证一下:
workrally auth status显示已登录就 OK 了。
看看有哪些命令
WorkRally 的命令很多,但不用记,随时可以 --help 查看。
也可以看模型列表:
workrally generate image-models workrally generate video-models workrally generate audio-models模型 ID 必须动态获取,不要硬编码——这是官方强调的规则。
实战:三步做出第一条漫剧

光说不练假把式,我们来走一遍完整流程。
第一步:创建项目和剧集
先建一个项目:
workrally project create 「我的第一部漫剧」 -o json会返回项目 ID,记下来。
然后在项目下面建一集:
workrally series create --project-id <项目 ID> --name 「第一集」 -o json记下剧集 ID。
第二步:批量创建场次
场次就是镜头。我们批量创建几个场次:
workrally shotlist create --series-id <剧集 ID> --json-list '[ {「image_prompt」:「古风庭院,一个白衣少女站在樱花树下,唯美风格」}, {「image_prompt」:「少女抬头仰望天空,樱花飘落,特写镜头」}, {「image_prompt」:「少女转身离开,背影渐行渐远,远景镜头」} ]'每个场次都有图片提示词和视频提示词,上面的例子只写了图片的。
第三步:生成图片、视频、音频
选好模型,然后批量生成。
先看看有哪些模型可用:
workrally shotlist models --category image,video,audio -o json选好模型 ID 后,设置到场次上:
workrally shotlist set-model --series-id <剧集 ID> \ --image-model <图片模型 ID> --image-aspect-ratio 16:9 \ --video-mode SubjectToVideo --video-model <视频模型 ID> \ --duration 5 --video-aspect-ratio 16:9 \ --audio-model <音频模型 ID>然后生成:
workrally shotlist generate-image --project-id <项目 ID> --story-ids <场次 ID1>,<场次 ID2>,<场次 ID3> workrally shotlist generate-video --project-id <项目 ID> --story-ids <场次 ID1>,<场次 ID2>,<场次 ID3> workrally shotlist generate-audio --project-id <项目 ID> --story-ids <场次 ID1>,<场次 ID2>,<场次 ID3>查看生成进度:
workrally shotlist get-result --story-id <场次 ID> --type image --watch workrally shotlist get-result --story-id <场次 ID> --type video --watch workrally shotlist get-result --story-id <场次 ID> --type audio --watch等全部生成完,一条漫剧就做好了。
整个过程,全部在命令行里完成,不需要打开任何网页。
Agent 时代的创作方式

WorkRally 最有意思的地方,是它从设计之初就是为 AI Agent 服务的。
什么意思呢?
普通的 AI 工具,是给人用的——你打开网页,点按钮,填参数。
但 WorkRally 不一样,它提供了完整的 Skill 定义,AI Agent 可以直接理解和调用。
你把 WorkRally 的 Skill 装到 Codex 或者 Claude Code 里,然后跟 AI 说:
「帮我做一部关于太空冒险的漫剧,主角是一个机器人,三集,每集五个镜头。」
然后 AI 就会自动:
创建项目和剧集 设计角色并上传到资产库 写好每个场次的提示词 生成图片 生成视频 配上音效 最后把成品给你
整个过程你不需要敲一条命令,全部由 AI 代劳。
这才是真正的 AI 辅助创作——不是 AI 替你想创意,而是 AI 替你干体力活。
而且因为是 CLI 工具,你还可以把它集成到自己的自动化流水线里,比如 GitHub Actions、定时脚本等等。
想象一下:每天早上自动生成一条漫剧,发到短视频平台——这在以前是不敢想的。
适合谁用

讲了这么多,WorkRally 到底适合谁呢?
漫剧创作者:如果你在做 AI 漫剧,WorkRally 的场次管理和资产库功能会大幅提升你的生产效率。角色不用每次重画,场次可以批量生成,比一张一张地抠效率高多了。
独立开发者:如果你想做自己的 AI 视频应用,WorkRally 可以作为底层引擎。你不用自己对接一堆 AI 模型,直接调 WorkRally 的 CLI 或 API 就行。
AI Agent 玩家:如果你在用 Codex、Claude Code 这些 AI 编程助手,装一个 WorkRally Skill,让 AI 帮你做视频。这个体验真的很不一样。
内容团队:如果你们团队在批量生产 AI 内容,WorkRally 的项目管理和协同画布可以提升团队协作效率。
怎么开始
想上手的话,建议按照这个顺序:
先去 GitHub 星标一下项目:https://github.com/Tencent/workrally 去官网申请 API Key:https://workrally.qq.com/open-api 全局安装 CLI: npm install -g workrally试着生成一张图、一段视频,感受一下 走一遍完整的「项目→剧集→场次→生成」流程 如果用 AI 编程助手,装上 Skill,让 AI 帮你操作
目前项目还在快速迭代中,版本已经到 2.10.1 了,功能比较稳定。
腾讯出品,质量还是有保障的。
写在最后
AI 漫剧这个赛道,最近越来越热闹了。
从最开始的「一句话生成视频」,到现在的工业化生产流水线,工具进化得很快。
WorkRally 这种CLI + Skill 的形态,我个人非常看好。
因为它不是把用户关在一个黑盒里,而是把能力开放出来,让你可以自由组合、自由集成、自由创造。
AI 创作的未来,不应该是「一键生成」的懒人模式,而应该是「人机协作」的增效模式——人负责创意和审美,AI 负责执行和重复劳动。
WorkRally 走的,就是这条路。
感兴趣的朋友,不妨去试试。