ai-art-engineDeepSeek Harness plugin

AI 艺术创作引擎,专业的短视频创作工具

Stars
116
Forks
14
License
NOASSERTION
Last commit
Sep 1, 2026
Latest release
v5.0.7

Overview

AI 艺术创作引擎,专业的短视频创作工具

Original README

Cached from the project repository on Sep 3, 2026. This is source content, separate from the Agents.md review above.

View source

AI Art Engine

专业 AI 创作工具 · 短剧 · 广告 · 成片

本地工程与素材 · 分镜与节点图驱动生成 · 内置 MCP Server 可被 Claude Code 等 AI Agent 驱动
对接 OpenRouter · OpenAI · DeepSeek · 智谱 · Kimi · xAI · Google · vLLM · Ollama · LM Studio · 火山方舟 · 可灵 · MiniMax · 通义千问 · 魔塔 · ComfyUI · MagicRouter · Meshy · Tripo · Rodin(Hyper3D) · Luma AI · Lux3D
对象存储:火山 TOS · 阿里云 OSS · 腾讯云 COS

GitHub stars GitHub forks release downloads license version

local graph platform

官网 · 使用手册 · 视频生成指南 · 短视频教程 · ComfyUI 教程 · MCP 接入 · 视频教程 · Download · GitHub · Gitee · 交流 · Features · Quick Start · English


源码仓库

两个仓库的 main 分支保持同步;Release 与客户端自动更新仍以 GitHub 为准。


Download

PlatformPackageGet it
Windows.exeGitHub Releases
macOS.dmgx64 / arm64GitHub Releases:Intel 选 x64,Apple Silicon 选 arm64(仅 arm64 时 Intel Mac 会提示不支持)
Linux.AppImageGitHub Releaseschmod +x 后运行)

推送 v* tag 可由 GitHub Actions 自动构建并发布多平台安装包。也可自行打包:

bash
npm run dist:win    # Windows
npm run dist:mac    # macOS
npm run dist:linux  # Linux

Features

AIArtEngine 是面向短剧、广告与成片制作的专业 AI 创作工具:资产、分镜、节点图在同一桌面端完成,工程本地优先,模型调用走你自己的 API Key。

特色功能:AI 对话 + MCP

应用内聊天即可驱动全部生成与编排能力;Claude Code / Codex 等外部 AI Agent 也能直连操作你的工程。

  • AI 对话面板 — 应用内 AI 助手(DeepSeek Harness 运行时):在对话里 @ 引用工程资产、让 Agent 调用 MCP 工具直接干活——生成图片 / 视频 / 3D / 语音、编辑节点图、运行工作流并查状态;多会话历史、模型可选任意已配置文本模型
  • MCP 工具服务 — 内置 MCP Server,Claude Code / Codex 等外部 AI Agent 可经 stdio 桥或 HTTP 直连操作你的工程(规划并落盘工作流、运行生成、读写资产与节点图);token 跨重启持久复用、操作审计、并发闸门

特色功能:Skill 技能系统

技能是"职业手册"——告诉 Agent 怎么做(流程、规范、输出格式);MCP 工具是"手脚"——真正动手执行。两者配合,对话才能"说到做到"。

  • 内置创作技能 — 随对话自动就位,无需配置:分镜 / 动画(9 宫格分镜表、节拍拆解表、动态提示词表、4 宫格动态分镜表等)、导演审核、系统创作(剧本、图生提示词、图片 / 视频生成、声音、情绪、灯光、多角度、扩图、重绘、抠图、高清放大、界面图、界面拆分、世界提取、节拍拆分、节拍单元生成、策划案、肖像贴图、提示词优化、擦除)
  • 自定义技能 — 设置 → 自定义技能:把符合 dsh SKILL.md 格式(frontmatter name / description + Markdown 正文)的 .md 文件放进技能目录,下次对话自动生效;目录内一键「生成示例模板」
  • 机制 — 技能清单以 <available_skills> 注入对话上下文,Agent 判断任务匹配时按需加载技能文件作为指令;内置技能由程序自动管理(快照 + 指纹去重),自定义技能不受影响。节点图节点也使用同一套技能定义节点行为

完整能力

  • 本地工程 — 新建 / 打开 / 最近列表,JSON + 媒体目录落盘,数据不出本机
  • 资产库 — 图片 / 视频 / 声音 / 3D 模型;AssetRef GUID;.aipackage 导入导出
  • 分镜与画布 — 镜头参数、Fabric 构图、可停靠布局
  • 一键工作流 — 预设模板(短剧分镜、游戏UI界面、游戏买量、产品广告、电商带货、游戏3D资产、漫画出版、知识口播、3D白模预演等)或 AI 规划拓扑,一键创建可复用宿主资产(边界 I/O + Dive 内图)
  • 节点图生成 — 文本 / 图片 / 视频 / 声音 / 3D 模型节点,指令面板与模型参数;生成锁定、图库双输出口;端口类型必须相同(单数不能进复数,选取节点只收列表口);连线样式 / 小地图;任务队列复用共同上游、任务容错模式(节点失败降级不整链中断);漫画页(分镜格 + 台词气泡,导出透明 PNG)、广告变体矩阵、媒体质检 / 返工(专用质检模型五维评分 → FAIL 自动注入原因重试)、2D 帧动画与帧动画序列图、图层分离(拆层后可导出 PSD)
  • 宿主资产 — 外层暴露边界口,内图可 Dive;多汇点各建独立出口
  • 导演台 — 3D 站位截图与动作录制(写入 Cache/Videos);方形口 out-shots / out-actions;3D 模型输入端口,dive 自动实例化到舞台;全景图输入自动设为背景;AI 白模搭场景、20+ 种基础几何体、材质贴图覆盖(基础 / 法线贴图)、着色模式与线框模式
  • 成片时间线 — 素材分组与上轨编排;画中画叠加(位置 / 尺寸 / 不透明度 / 音量)与视频轨转场;预览播选中 / 时间线整轨联播;导出成片
  • 多模型提供商 — OpenRouter、OpenAI(GPT 文本 / gpt-image 图片)、DeepSeek(文本)、智谱(GLM 文本 / CogView 图片)、Kimi / 月之暗面(文本)、xAI / Grok(文本 / 图片 / 视频)、Google / Gemini(文本 / 图片 / 视频)、本地 vLLM(文本 / Wan 视频)、Ollama / LM Studio(文本,OpenAI 兼容,无需 API Key)、火山方舟(Seedream / Seedance / 声音)、可灵、MiniMax、通义千问(DashScope)、魔塔(ModelScope)、ComfyUI(API 2:图片 / 视频 / 声音,本机或云端 Base URL)、MagicRouter(聚合网关:文本 / 图片 / 视频)、Meshy / Tripo / Rodin(Hyper3D) / Luma AI / Lux3D(3D 模型生成,文生 3D / 图生 3D)
  • 对象存储 — 火山引擎 TOS、阿里云 OSS、腾讯云 COS(同时仅可启用一个,用于参考视频等公网外链)
  • 可扩展 — Editor Kernel + Cordis 内部扩展(窗口 / Inspector / 节点 / Skill / 执行器)+ 声明式外部插件清单

模型与对象存储一览

类型提供商能力概要
模型OpenRouter文本 / 图片 / 视频(聚合目录)
模型OpenAI文本 / 图片(需可访问 api.openai.com 的网络与账号)
模型DeepSeek文本(deepseek-chat / deepseek-reasoner)
模型智谱GLM 文本 / CogView 文生图
模型Kimi(月之暗面)文本(kimi-k2 系列 / moonshot-v1 系列)
模型xAI(Grok)文本 / Grok Imagine 图片 / Grok Imagine Video(异步轮询)
模型Google(Gemini)文本 / Nano Banana 图片 / Veo 3.1 视频(异步轮询,官方 OpenAI 兼容层)
模型vLLM本地文本 / 视频(Wan T2V / I2V,OpenAI 兼容,无需 API Key)
模型Ollama / LM Studio本地文本(OpenAI 兼容,无需 API Key)
模型火山方舟文本 / Seedream 图 / Seedance 视频 / 声音设计
模型可灵图片 / 视频(API Key)
模型MiniMax文本 / 图片 / 视频 / 音色设计
模型通义千问文本(兼容模式)/ 万相图 / 万相视频(含 HappyHorse 等)
模型魔塔文本 / 文生图(访问令牌)
模型ComfyUI图片 / 视频 / 声音(API 2;本机 8189 或云端 Base URL)
模型MagicRouter文本 / 图片 / 视频(OpenAI 兼容聚合网关,视频异步轮询)
模型Meshy文生 3D / 图生 3D(含多图生 3D,API Key)
模型Tripo文生 3D / 图生 3D(API Key)
模型Rodin(Hyper3D)文生 3D / 图生 3D(API Key)
模型Luma AI文生 3D / 图生 3D(API Key)
模型Lux3D文生 3D / 图生 3D(含多图生 3D,G1 / G1-Turbo,API Key)
对象存储火山 TOS / 阿里云 OSS / 腾讯云 COS参考媒体上传与签名 URL;设置中互斥启用

配置入口:设置 → 模型 / 设置 → 对象存储。本机 ComfyUI 需先装 comfy-api-proxy(默认 8189),不要直连 8188。


Quick Start

用安装包

  1. Releases 下载对应平台包
  2. 安装启动 → 新建工程
  3. 设置里添加模型提供商并填写密钥;可选配置对象存储
  4. 顶栏「一键工作流」快速出宿主资产,或在分镜 / 节点图中手搭链路
  5. 点左侧窄栏「◈」打开 AI 对话,@ 引用资产让助手直接生成;或按 MCP 接入教程 接入 Claude Code 等外部 Agent

完整操作说明见 使用手册(源码在 website/manual.html)。本机 ComfyUI 需先装 comfy-api-proxy(默认 8189),不要直连 8188。

从源码

bash
# GitHub
git clone https://github.com/Justin-sky/ai-art-engine.git

# 或使用 Gitee 国内镜像
git clone https://gitee.com/beijing_blue_whale_era_zhangjian/ai-art-engine.git

cd ai-art-engine
npm install
npm run dev

开发构建需要 Node.js 22+(运行时已内置 Node,用户无需安装)。Electron 下载失败时可:

bash
set ELECTRON_MIRROR=https://cdn.npmmirror.com/binaries/electron/
node node_modules/electron/install.js
bash
npm run typecheck && npm test   # 检查
npm run pack                    # 未封装目录,便于自测

文档


版本与更新

  • 版本号以 package.jsonversion 为准(SemVer),变更记录见 CHANGELOG.md
  • 发版:先改 package.json 与 CHANGELOG,提交后打 tag 并推送,例如:
bash
git tag v5.0.0
git push origin v5.0.0

CI 会校验 tag(去掉 v)与 package.json 一致,再构建并发布 GitHub Release(含 latest.yml 等更新元数据)。

  • 客户端更新:安装包启动后会检查 Releases;也可在 设置 → 通用 → 关于与更新 中手动检查,下载完成后重启安装。开发模式(npm run dev)不检查更新。

Contribute

欢迎 Issue 与 Pull Request。提交前建议:

bash
npm run typecheck && npm test

讨论与缺陷跟踪可使用 GitHub IssuesGitee Issues


交流


Stack

Electron · Vue 3 · Pinia · TypeScript · Cordis · Fabric.js · electron-vite · electron-builder


License

GPL-3.0 — 修改并再分发时,衍生作品需以相同协议开源。


如果这个项目对你有帮助,请点一颗 ⭐ Star