从剧本到成片自己搭一套 AI 漫剧平台(AID Studio)
AID Studio 是一套用 Java 与 TypeScript 开发的开源 AI 漫剧创作平台,可自行部署,把剧本、角色素材、分镜、图片、视频、配音和计费放进同一套系统。这篇文章讲清它第一次部署需要准备什么、最短怎么跑通第一条分镜、后台要配哪些参数、结果落在哪里,以及 6 个开放 Issue 里真实用户踩过的坑,帮读者判断自己该不该动手搭。
剧本、角色、分镜、图片、视频、配音这几件事,在多数团队手里散落在好几个网页工具里。角色换一个工具就长得不一样,任务排队断了不知道重试到哪一步,模型账单还得另开表格记。AID Studio 把这条链路收进一个可以自己部署的平台,剧本、素材、分镜和成片围绕同一个项目组织,模型统一在后台接入。
AID Studio 是一套用 Java 与 TypeScript 开发的开源 AI 漫剧创作平台,输入剧本与参考图,输出分镜图、视频片段与配音成片。

它面向两类人。一类是把 AI 漫剧、短剧、电影或静态漫画做成产品的内容团队,需要后台管模型、积分、订单和用户;一类是愿意自己拿服务器跑服务的开发者。源码按 MIT 协议开放,主要语言 Java,仓库在 https://github.com/gzxx-2025/aid-studio ,截至抓取时 837 Star、189 Fork、3 Watcher、6 个开放 Issue,最近一次提交在 2026 年 10 月 1 日。官方还提供了一个在线体验站点 www.aidstudio.com.cn,想先看界面再决定要不要部署,可以先从那里进去点一圈。
第一次用它需要知道的事
- 服务器规格有下限。不启用 RocketMQ 且中间件同机时,最低为 2 核 / 4 GB 内存 / 40 GB 磁盘,推荐 4 核 8 G / 100 G 以上;启用 RocketMQ 时最低 4 核 4 GB,仓库说明这个下限只用于本机搭建和功能验证,需要收紧 JVM 与 MQ 参数。
- 模型必须自己配。源码按 MIT 提供,但 AI 生成需要配置相应供应商的 API 凭证,模型调用、服务器和存储都可能产生费用。后台没有启用任何模型时创作流程走不动,Issue 里就有人反馈「搭建完了后发现跑不起来」。
- 端口和域名提前规划。用户端默认走 80 端口,可以用
HTTP_PORT调整;启用 HTTPS 需要用户域名、管理域名、443 端口以及完整证书链和私钥。仅设置HTTP_PORT=443不会自动启用 TLS。 - 媒体文件建议外置。仓库强烈建议把媒体文件配置到 OSS/COS 对象存储,本地磁盘只作兜底。
- 本地开发另有一套依赖。要求 JDK 17+、Maven 3.6+、Docker,用 Docker 起 MySQL 与 Redis 中间件。
最短上手路径
- 准备一台全新的 64 位 Linux 服务器,按上面的规格留足内存与磁盘。
- 把安装脚本下载到
/root/aid-install.sh,脚本会优先从 Gitee 拉取,失败后自动切换到 GitHub。 - 执行
sudo env AID_REMOTE_BOOTSTRAP=1 AID_RELEASE_CHANNEL=auto bash /root/aid-install.sh install,未部署时默认进入 Docker 首次安装。 - 首次安装会先生成配置并要求管理员检查确认,配置未确认前不会拉源码、构建程序、初始化数据库或启动服务。
- 安装完成后运行
sudo aid default查看用户端与管理端地址,首次登录立即修改管理员密码。 - 进入管理端配置文本、图片模型;需要视频和配音时,再配置对应模型并核对能力、凭证与费用后启用。
- 新建一个项目,准备一小段剧本和一个分集,整理角色与场景,跑通一个分镜后,再选择已启用的视频模型生成片段。
它实际上能做哪些事
创作链路
- 剧本与分镜。项目、剧本、分集管理,AI 辅助剧本创作与场景资产提取,分镜脚本生成、镜头组拆分和视频提示词生成。
- 素材与视觉一致性。角色、道具、场景做成形象资产库并管理参考图,官方与自定义风格、项目风格快照可以复用,参考图按模型能力安全编排。角色配音可以绑定到角色上,减少跨分镜的形象漂移。
- 图像、视频与配音生成。文生图、图生图、多图融合;图生视频、首尾帧、多镜头批量出片;TTS 多音色、音色库管理与对口型。清晰度、时长、比例按所选模型的能力校验,能力以模型为准,仓库没有承诺任何模型的固定效果。
平台能力
- 多模型接入。文本、图片、视频和语音模型通过统一 Provider 接入,模型能力、参考图数量、分辨率、时长和比例均可配置;API 网关支持按兼容协议配置访问地址与凭证,也能按模型设置例外。
- 统一任务系统。生成任务排队、并发调度、进度推送、失败重试、补偿和结果回收。
- 计费与用户运营。按模型/SKU 计费、余额冻结与结算、充值套餐、支付宝与微信支付;账号、短信、邮箱、微信扫码登录,实名认证与邀请激励;后台统一管理模型、供应商、智能体、提示词、内容、订单、用户和存储。
部署与运维
- 两种部署方式。Docker 方式的配置真源在
/data/aid/config/docker.env,以 Docker Compose 运行;手动部署的配置真源在/data/aid/aid-deploy.conf,以 systemd + Nginx 运行。服务端、管理端、Web 端与升级器从同一个版本标签构建。 - 在线升级与回退。页面和命令行都能检查更新、查看实时进度并执行回退,配套独立的升级器
aid-updater。
参数速查
后端全部环境参数支持环境变量覆盖:DB_*、REDIS_*、TOKEN_SECRET(生产必须注入强随机值)、AID_PROFILE、ROCKETMQ_ENABLED(未部署 RocketMQ 时设为 false 可完全关闭 MQ 装配,系统走本地任务模式)、ROCKETMQ_NAMESERVER。安装渠道由 AID_RELEASE_CHANNEL 控制,auto 优先正式版,固定正式渠道用 stable,明确测试预发布版本才用 beta。
部署完成后,两种安装方式共用同一套管理命令:
sudo aid # 交互式管理菜单
sudo aid default # 查看用户端、管理端地址及初始化账号说明
sudo aid status # 检查服务、中间件和升级器状态
sudo aid logs # 查看运行日志
sudo aid config # 编辑当前部署配置并按提示生效
sudo aid restart # 重新加载配置并重启服务
sudo aid update # 检查并执行当前渠道更新
sudo aid progress # 查看升级、升级器更新或回退的实时进度
sudo aid rollback # 选择官方允许回退的历史版本
sudo aid backup # 创建部署备份
sudo aid uninstall --keep # 卸载程序但保留数据与配置
sudo aid uninstall --purge # 二次确认后完整清除 AID 数据
输出与结果位置
用户端默认地址是 http://服务器IP/,管理端地址和随机访问码以 sudo aid default 的输出为准。部署日志写在 /data/aid/logs/,HTTPS 证书默认放在 /data/aid/config/ssl/,也可以在管理端「项目升级配置 → 运行配置」里上传证书、配置域名并分别测试 DNS、证书和 HTTPS。
创作结果按项目组织:剧本和分集在项目内,角色、道具、场景在素材库,分镜图和视频片段挂在分镜下,配音绑定到角色后随分镜合成。本地开发时访问 http://localhost:8080 验证服务,数据库初始化管理员为 admin / admin123,首次登录后必须立即修改密码。
实际使用中的坑
- 2.1.9 版在威联通 NAS 上,用户端「剧本创作 → 历史剧本」打开后再关闭,整个界面冻结、鼠标点击无响应。这条 Issue 评论数最多,当前状态为已解决。
- 2.1.9 版 H3 模型不支持多参考图生成视频。v2.2.2 的更新说明里写明修复了 MiniMax H3 多参考视频错误回落到单首帧装配、从而拒绝多张参考图的问题,参考图会按模型能力去重、连续编号,超过上限时在提交前拒绝。该 Issue 已解决。
- 2.2.2 有用户反馈视频生成没有使用素材中的角色图,同版本还有视频生成失败的反馈,两条均为已解决状态。素材准备环节本身也有过一条 2.2.2 的 Bug 记录。
- 模型配置是新手最容易卡住的地方:有用户直接问「后台配置有没有教程呢,搭建完了后发现跑不起来」,2.1.9 版还有人遇到新增文生视频模型保存时报「提示媒体能力配置无效」。后者已解决,前者说明后台配置这一步缺少足够的引导。
替代方案一览
| 项目 | 适合谁 | 部署方式 | 主要限制 | 什么情况下选它更合适 | 项目地址 |
|---|---|---|---|---|---|
| AID Studio | 想把 AI 漫剧或短剧做成带后台的产品的团队,以及愿意自己维护服务器的开发者 | Docker Compose 或 systemd + Nginx,最低 2 核 4 GB / 40 GB 磁盘 | 必须自备模型供应商 API 凭证并在后台逐个启用;模型调用、服务器和存储都会产生费用;生成效果取决于模型与输入素材 | 需要把剧本、分镜、视频、配音和计费放进同一套系统并自己掌控数据时 | gzxx-2025/aid-studio |
| AutoClip | 手上已经有长视频、要批量切条分发到多个平台的人 | 仓库没有说明 | 它做的是长视频二次剪辑与分发,不生成原始画面,也不处理剧本、角色资产和配音合成 | 素材已经拍好或剪好,只需要切条和分发 | AutoClip |
| zhouxiaoka/autoclip | 想拿源码自己搭长视频切条流程的开发者 | 仓库没有说明 | 未逐一核实;从定位看同样面向长视频切条,不涉及 AI 生成 | 需要自己改切条逻辑、接入自己的分发渠道时 | zhouxiaoka/autoclip |
AutoClip 那一类工具处理的是已有成片,AID Studio 处理的是画面从零生成,两者输入不同。如果团队手上已经拍好了素材、只需要切条投多个平台,AID Studio 帮不上忙,得用 AutoClip 这条路线;反过来,如果要的是从剧本生成分镜和视频片段,切条工具也替代不了它。把这两类放在一起,只是给做同类选型的人一个横向参照。
别踩的合规线
平台本身是内容生成工具,合规风险集中在素材与输出两端。仓库在「第一个漫剧项目」里明确要求生成或上传有权使用的角色、场景图片,用他人作品做参考图之前先确认授权。生成的图片和视频还要遵守所接入模型供应商的服务条款,各家的内容审核口径不同,被拒答的原因在系统里会如实回传。
用 MIT 协议分发意味着你可以自部署、二次开发和商用,但 LICENSE 与 NOTICE 文件需要一并保留。把平台对外运营时,用户上传的素材、生成内容的留存与展示范围、支付与实名认证涉及的合规义务,都落在部署者自己身上,仓库不代为承担。
什么时候值得用它
你要做的是连续分集的漫剧或短剧,需要角色和场景在多集之间保持一致,AID Studio 的资产库和风格快照正是为这件事设计的,值得动手部署。
你需要一套带用户、积分、订单和支付的后台,而不是一个只能自己用的生成页面,这套平台把运营能力一起给了,比自己拼接口省事。
你手上有一台能长期开着的 Linux 服务器,并且接受为模型调用持续付费,那么它的 Docker 部署和 sudo aid 系列管理命令能把运维成本压得比较低。
焚评:这个项目的量化评分
本项目的选题来自 焚.com(一个按公开公式给 GitHub 项目打分的站)。焚评当前总分 9.2 分(满分 10)。下表是各维度的得分:
| 评分维度 | 得分 |
|---|---|
| 热度动量(权重 25%) | 10.0 / 10 |
| 开发活跃(权重 25%) | 7.1 / 10 |
| 社区响应(权重 15%) | 9.7 / 10 |
| 文档质量(权重 15%) | 10.0 / 10 |
| 发布节奏(权重 10%) | 9.9 / 10 |
| 风险控制(权重 10%) | 10.0 / 10 |
评分口径、权重与计算方式见焚.com 的评分方法页;数据随 GitHub 指标刷新,具体数值以焚.com 当前页面为准。本文正文为诀.com 独立撰写,评分数据由焚.com 授权引用。
内容核验说明
收录它是因为把部署门槛、参数清单和踩坑记录放在了一起:服务器规格、HTTPS 前置条件、模型凭证必配、命令速查、结果落盘位置,都是动手前要核对的。适合准备自建漫剧或短剧后台、自带模型预算的团队与开发者。文中 Star、Fork 与评分数据来自原作者公开披露,诀.com 未独立验证;生成效果与部署稳定性没有第三方实测。
文章数据(Star、Fork、提交时间、评分数值)来自原作者与焚.com 的公开披露,诀.com 未独立验证;服务器规格、命令与端口规则系转述仓库文档,未做实际部署测试;Issue 状态以仓库标记为准,问题是否真正修复未见第三方复现。用户反馈摘要
根据仓库 Issue 来看,反馈集中在后台配置和生成链路。多名提交者报告模型未启用或规格不符时启动即报错、新增模型保存提示「媒体能力配置无效」,也有人直接问后台配置缺教程。另有视频生成失败、未使用素材中的角色图、场景设定未写入库、界面冻结、模型收费方式切换价格错乱等报告,这些 Issue 状态均显示已解决。
基于该仓库公开 Issue 整理,只反映提交者报告的现象与诉求,不代表诀.com 立场,也不代表问题已被确认。项目来源与说明
开源项目:gzxx-2025(gzxx-2025)
本文由诀.com 编辑基于该项目的公开信息独立撰写,属原创解读,不是对项目文档的翻译或转载;文中提到的功能与参数以官方仓库为准,代码与文档版权归原作者所有。
查看项目仓库