夜雨聆风学习资料网

ARTICLE · 1037893

一套桌面端 AI 创作工具:短剧、广告、成片都覆盖了

一套桌面端 AI 创作工具:短剧、广告、成片都覆盖了

前言

短剧、广告、成片这类内容制作,工具链通常是散的:分镜用一个软件,生成图片用一个平台,视频和 3D 又是另外几套,素材来回倒腾。AIArtEngine 想做的事是把资产、分镜、节点图放进同一个桌面端,工程本地落盘,模型调用走自己的 API Key,再通过内置的 MCP Server 让外部 AI Agent 也能直接操作工程。

项目介绍

AIArtEngine 是一款面向短剧、广告与成片制作的专业 AI 创作工具。资产、分镜、节点图在同一桌面端完成,工程本地优先,模型调用走使用者自己的 API Key。

应用内提供 AI 对话面板,内置 MCP Server,Claude Code、Codex 等外部 AI Agent 也能直连操作工程。支持 Windows、macOS、Linux 三个平台。

项目功能

模块
功能
本地工程
新建、打开、最近列表,JSON + 媒体目录落盘,数据不出本机
资产库
图片、视频、声音、3D 模型,AssetRef GUID,.aipackage 导入导出
分镜与画布
镜头参数、Fabric 构图、可停靠布局
一键工作流
预设模板或 AI 规划拓扑,一键创建可复用宿主资产
节点图生成
文本、图片、视频、声音、3D 模型节点,指令面板与模型参数
导演台
3D 站位截图与动作录制,AI 白模搭场景,基础几何体、材质贴图
成片时间线
素材分组与上轨编排,画中画叠加,视频轨转场,导出成片
AI 对话
应用内 AI 助手,@ 引用工程资产,让 Agent 调用 MCP 工具直接干活
MCP 工具服务
内置 MCP Server,外部 AI Agent 可经 stdio 桥或 HTTP 直连操作工程
Skill 技能系统
内置创作技能随对话就位,自定义技能按 dsh SKILL.md 格式放入目录
多模型提供商
覆盖文本、图片、视频、声音、3D 生成的主流厂商
对象存储
火山 TOS、阿里云 OSS、腾讯云 COS,互斥启用

项目特点

工程本地优先:JSON 加媒体目录落盘,数据不出本机,模型调用走自己的 API Key。

Skill 和 MCP 分工明确:技能是“职业手册”,告诉 Agent 怎么做;MCP 工具是“手脚”,真正动手执行。两者配合,对话才能说到做到。

内置 MCP Server:Claude Code、Codex 等外部 AI Agent 可以经 stdio 桥或 HTTP 直连操作工程,token 跨重启持久复用,有操作审计和并发闸门。

技能机制自动管理:技能清单以 <available_skills> 注入对话上下文,Agent 判断任务匹配时按需加载技能文件作为指令。内置技能由程序自动管理,快照加指纹去重,自定义技能不受影响。

节点即技能:节点图节点也使用同一套技能定义节点行为,技能和节点行为统一。

一键工作流:短剧分镜、游戏 UI 界面、游戏买量、产品广告、电商带货、游戏 3D 资产、漫画出版、知识口播、3D 白模预演等预设模板,也可以让 AI 规划拓扑。

模型覆盖广:文本、图片、视频、声音、3D 生成各自有多个厂商可选,本地模型支持 vLLM、Ollama、LM Studio,无需 API Key。

可扩展:Editor Kernel 加 Cordis 内部扩展(窗口、Inspector、节点、Skill、执行器),支持声明式外部插件清单。

跨平台打包:推送 v* tag 可由 GitHub Actions 自动构建并发布多平台安装包,也可自行打包。

项目技术

层面
选型 / 说明
桌面端
Electron,内置 Node 运行时,用户无需安装 Node
开发环境
Node.js 22+
工程存储
JSON + 媒体目录,AssetRef GUID,.aipackage 导入导出
画布
Fabric
节点图
文本、图片、视频、声音、3D 模型节点,端口类型校验
AI 对话
DeepSeek Harness 运行时,多会话历史,模型可选任意已配置文本模型
MCP
内置 MCP Server,stdio 桥 / HTTP,token 持久复用、操作审计、并发闸门
技能格式
dsh SKILL.md(frontmatter name / description + Markdown 正文)
对象存储
火山 TOS、阿里云 OSS、腾讯云 COS
打包
npm run dist:win / dist:mac / dist:linux
检查
npm run typecheck、npm test
扩展
Editor Kernel + Cordis 内部扩展 + 声明式外部插件清单

模型接入方面,覆盖 OpenRouter、OpenAI、DeepSeek、智谱、Kimi、xAI、Google、vLLM、Ollama、LM Studio、火山方舟、可灵、MiniMax、通义千问、魔塔、ComfyUI、MagicRouter、Meshy、Tripo、Rodin(Hyper3D)、Luma AI、Lux3D,以及自定义提供商(OpenAI 兼容 / Anthropic / Gemini 端点)。

类型
提供商
能力概要
模型
OpenRouter
文本 / 图片 / 视频(聚合目录)
模型
OpenAI
文本 / 图片
模型
DeepSeek
文本(deepseek-chat / deepseek-reasoner)
模型
智谱
GLM 文本 / CogView 文生图
模型
Kimi(月之暗面)
文本
模型
xAI(Grok)
文本 / 图片 / 视频(异步轮询)
模型
Google(Gemini)
文本 / 图片 / 视频(异步轮询)
模型
vLLM
本地文本 / 视频,OpenAI 兼容,无需 API Key
模型
Ollama / LM Studio
本地文本,OpenAI 兼容,无需 API Key
模型
火山方舟
文本 / 图片 / 视频 / 声音设计
模型
可灵
图片 / 视频
模型
MiniMax
文本 / 图片 / 视频 / 音色设计
模型
通义千问
文本 / 万相图 / 万相视频
模型
魔塔
文本 / 文生图
模型
ComfyUI
图片 / 视频 / 声音(API 2)
模型
MagicRouter
文本 / 图片 / 视频(聚合网关)
模型
Meshy / Tripo / Rodin / Luma AI / Lux3D
文生 3D / 图生 3D
模型
自定义
文本(OpenAI 兼容 / Anthropic / Gemini 端点)
对象存储
火山 TOS / 阿里云 OSS / 腾讯云 COS
参考媒体上传与签名 URL,互斥启用

项目代码

从源码启动:

# GitHubgit clone https://github.com/Justin-sky/ai-art-engine.git# 或使用 Gitee 国内镜像git clone https://gitee.com/beijing_blue_whale_era_zhangjian/ai-art-engine.gitcd ai-art-enginenpm installnpm run dev

Electron 下载失败时的处理:

set ELECTRON_MIRROR=https://cdn.npmmirror.com/binaries/electron/node node_modules/electron/install.js

检查与打包:

npm run typecheck && npm test# 检查npm run pack                    # 未封装目录,便于自测npm run dist:win                # Windowsnpm run dist:mac                # macOSnpm run dist:linux              # Linux

项目效果

安装启动后新建工程,在设置里添加模型提供商并填写密钥,可选配置对象存储。顶栏「一键工作流」可以快速出宿主资产,也可以在分镜或节点图里手搭链路。点左侧窄栏的「◈」打开 AI 对话,@ 引用资产让助手直接生成,或者按 MCP 接入教程接入 Claude Code 等外部 Agent。

节点图里,文本、图片、视频、声音、3D 模型节点各自有指令面板和模型参数,生成结果有锁定和图库双输出口。任务队列会复用共同上游,节点失败时按容错模式降级,不会整链中断。漫画页支持分镜格加台词气泡,导出透明 PNG;广告变体矩阵适合批量出素材;媒体质检用专用质检模型做五维评分,FAIL 自动注入原因重试。

导演台支持 3D 站位截图与动作录制,全景图输入自动设为背景,AI 白模搭场景配 20+ 种基础几何体,材质贴图覆盖基础贴图和法线贴图,支持着色模式与线框模式。成片时间线支持素材分组上轨、画中画叠加、视频轨转场,预览可播选中或整轨联播,最后导出成片。

项目源码

GitHub:https://github.com/Justin-sky/ai-art-engine

Gitee:https://gitee.com/beijing_blue_whale_era_zhangjian/ai-art-engine

两个仓库的 main 分支保持同步,Release 与客户端自动更新以 GitHub 为准。

客户端安装包在 GitHub Releases 下载,Windows 是 .exe,macOS 是 .dmg(Intel 选 x64,Apple Silicon 选 arm64),Linux 是 .AppImage(chmod +x 后运行)。

总结

AIArtEngine 的思路是把内容制作的多条链路收进一个桌面端:资产、分镜、节点图、导演台、成片时间线在同一工程里流转,生成能力通过节点图编排,模型走自己的 API Key。Skill 和 MCP 的分工设计是这套工具比较特别的地方——技能负责告诉 Agent 怎么做,MCP 工具负责动手执行,外部 AI Agent 也能通过 MCP 直连操作工程。模型覆盖从云端到本地,3D 生成有多个厂商可选,对象存储用来做公网外链。对于做短剧、广告、成片这类内容、又希望工程和素材留在本地的场景,这套工具值得试试。

关键词

#AI创作工具#短剧制作#广告成片#节点图、分镜、MCP Server、#Skill技能系统、本地工程、#多模型接入、3D生成、ComfyUI、#对象存储#Electron、Claude Code

作者:小码编匠

出处:gitee.com/smallcore/DotNetCore

声明:网络内容,仅供学习,尊重版权,侵权速删,歉意致谢!

END

权限、菜单、日志都写好了,这套现代化后台直接改业务就行

云端停车场管理系统:智能停车、车位管理与费用结算
一个开源的自由接入主流大模型超级 AI 助理
工业物联网管理平台(IoT)社区源码版,拆开看看
一款物联网平台该有的样子:集成设备管理、数据采集与开放API

零成本模拟工业设备:PLC、传感器、摄像头全流程测试方案

基于 EasyTier 一款美观实用的远程联机工具

一套可私有化部署的开源私域营销 AI 系统

一个轻量级的摄像头多屏监控工具,支持大华和海康

企业级智能问答系统:开箱即用的 RAG + LLM 工作流引擎

面向 Vue 3 的可视化低代码流程设计器

3 秒搞定 30 秒视频!基于 YOLOv8 + FastAPI 的关键帧提取神器

入门即用的 Vue3+Django+Docker 后台管理系统

Vue 3 + Three.js 开源三维可视化框架,含智慧工厂、数字城市等场景案例

AI + 零代码平台,支持在线拖拽式二次开发

一套开源、毫无保留、本地优先的 AI 工作站

告别手写 SQL:一个带自学习能力的开源 BI 工具

开箱即用的 Vue3 管理系统框架(面向 AI 编程)

边缘采集+云端上报,这套网关底座的监控面板比想象中更细

一套干净好用的 Vue3 后台管理模板(Naive UI + TS)

开源、零后端依赖的 Web 打印模板可视化设计器

一套平台,搞定昇腾、Jetson、RK3588 等多种边缘算力

开源 Web 音视频会议系统,支持私有化与免费部署

工业边缘计算系统搭建:配置、协议、部署路径记录

支持 GB28181 和 RTSP,这套开源监控方案还集成了 YOLO 与大模型复核

一款实用的开源 Redis 管理工具

一个独立授权管理系统,搞定软件授权码生成、验证和分发

备注【开源

方便大家交流、资源共享和共同成长

纯技术交流群、需要的小伙伴请扫码

有收获?不妨分享让更多人受益

关注「程序员开源栈」,共同提升技术实力

点分享
点收藏
点在看
点点赞

相关学习资料