Back to skills
SKILL.md
Comic Drama Production
ASecurity漫剧制作全流程工作流。漫剧是介于漫画和短剧之间的新形态——用AI生成的高质量静态图/动态图配配音和音乐来讲故事。涵盖剧本改编、分镜设计、角色设定、背景生成、配音配乐、剪辑合成。
- 2 stars
- 0 votes
- 0 copies
- 0 views
- Added October 6, 2026
Works with
Security analysis
100/100npx -y skills add Kairos-ai-agent/kairos-code --skill comic-drama-production --agent claude-codeAre you the author of Comic Drama Production?
Add the live security badge to your README. It updates with every re-scan.
[](https://www.skillsdirectory.com/skills/kairos-ai-agent-comic-drama-production)---
name: "comic-drama-production"
description: "漫剧制作全流程工作流。漫剧是介于漫画和短剧之间的新形态——用AI生成的高质量静态图/动态图配配音和音乐来讲故事。涵盖剧本改编、分镜设计、角色设定、背景生成、配音配乐、剪辑合成。"
priority: 0.5
imported-from: "hermes"
source-path: "hermes/skills/creative/comic-drama-production/SKILL.md"
---
# 漫剧制作工作流 · Comic Drama Production
> **母版驱动资产提示词**:本 skill 整合了「角色定妆图A版」「场景设计图A版」「道具设计图A版」三套提示词母版
> 详情见 `references/角色定妆图提示词a版.md`、`references/场景设计图提示词a版.md`、`references/道具设计图提示词a版.md`
## 什么是漫剧
漫剧(Comic Drama)是2024-2025年兴起的短视频新形态:
- **视觉**:用AI生成的漫画/插画风格静态帧,配合运镜效果(推拉摇移)
- **音频**:AI配音(多角色TTS)+ 背景音乐 + 音效
- **叙事**:类似短剧的剧情节奏,但视觉上更接近动态漫画
- **平台**:抖音/B站/小红书/快手竖屏短视频
## 漫剧 vs 短剧 vs 传统动画
| 维度 | 漫剧 | 竖屏短剧 | 传统动画 |
|------|------|---------|---------|
| 制作成本 | 低(AI生成) | 中(真人拍摄) | 极高 |
| 制作周期 | 1-3天/集 | 1-2天/集 | 数周/集 |
| 视觉风格 | 插画/漫画风 | 真人实拍 | 全动画 |
| 运镜 | AI模拟运镜 | 真实摄影 | 全动画运镜 |
| 配音 | AI TTS | 真人录音 | 声优配音 |
| 视频帧率 | 静态图+运镜 | 24/30fps | 24fps |
## 制作流程概览
```
剧本 → 资产提取/提示词 → 角色定妆 → 场景设计 → 分镜/关键帧生成 → 配音 → 后期合成 → 发布
```
## 第一步:剧本与改编
### 剧本来源
- 原创剧本 → 使用 short-drama-scriptwriting skill
- 小说改编 → 提取关键情节、对话、场景
- 已有短剧改编 → 简化场景、增强视觉表现力
### 漫剧剧本特点
| 要素 | 漫剧写法 | 原因 |
|------|---------|------|
| 场景描述 | 更详细 | AI需要精确的画面描述来生成 |
| 动作 | 分解为关键pose | 静态帧需要抓住最具张力的瞬间 |
| 对话 | 更密集 | 漫剧靠对话推进,靠画面辅助 |
| 内心OS | 可加入画外音 | 漫剧适合展示角色内心 |
| 转场 | 明确的视觉过渡 | 弥补静态图之间的跳跃 |
## 第一步1/2:资产提取与提示词生成(母版驱动)← ⭐ 易错环节
> ⚠️ **常见错误**:直接写角色/场景/道具的描述段落,不按母版 SECTION 结构写。结果是提示词"不完整",缺少三视图、表情组、模块矩阵等技术要素。
> **正确的做法**:每项资产严格对照对应母版变体的 SECTION 1/2/3 结构逐段填写,缺一段就是"不完整"。
### 工作流
```
完整剧本 → 提取资产清单 → 分类(角色/场景/道具) → 选择母版变体 → 按SECTION逐段填写 → 审计验证
```
### 第一步:提取资产清单
从剧本中提取三类资产:
| 类别 | 提取标准 | 判断依据 |
|:----|:---------|:---------|
| **角色** | 有台词/有动作/推动剧情的人物 | 出场次数 ≥ 2,有独立人设 |
| **场景** | 剧情发生地点 | 有明确环境描写、氛围设定 |
| **道具** | 推动剧情的物体 | 有功能描述、视觉特征、剧情作用 |
### 第二步:选择母版变体
| 资产类别 | 可用变体 | 选择依据 |
|:---------|:---------|:---------|
| **角色** | A1 档案/古籍 / A2 游戏设定集 / A3 科技档案 / A4 唯美幻想 | 古风→A1、战斗型→A2、赛博→A3、非武者→A4 |
| **场景** | S1 现代建筑 / S2 室内/复古 / S3 科幻赛博 / S4 奇幻幻想 | 室内古建→S2、科幻→S3、室外现代→S1、奇幻→S4 |
| **道具** | P1 家具陈设 / P2 武器装备 / P3 科技设备 / P4 魔法道具 | 冷兵器→P2、科技→P3、古籍陈设→P1、魔法→P4 |
### 第三步:按 SECTION 结构逐段填写(关键!)
**角色定妆图标准结构**(无论变体):
```
SECTION 1 — HERO PORTRAIT & IDENTITY: 主肖像 + 姓名/头衔/关键词标签
SECTION 2 — THREE-VIEW TURNAROUND: 正/侧/背三视图 + 高度标注
SECTION 3 — DETAIL MODULE MATRIX:
MODULE A — Expression Sheet 表情组(5-6种)
MODULE B — Costume/Texture 服饰与面料
MODULE C — Accessory/Weapon 配件/武器拆解
MODULE D — Color Palette 配色方案(有传统色名)
(OPTIONAL) MODULE E — Special 角色专属模块(义体/芯片/机械等)
(OPTIONAL) MODULE F — Lore 背景故事
```
**场景设计图标准结构**:
```
SECTION 1 — 标题横幅 + 主视觉宽幅建立镜头
SECTION 2 — 平面图/立面图(含编号图例)
SECTION 3 — 氛围/时间研究(多种光照条件对比)
SECTION 4 — 细节参考图集(材质/陈设/配色)
```
**道具设计图标准结构**:
```
SECTION 1 — 标题 + 设计说明
SECTION 2 — 主视觉渲染(3/4透视,照片级)
SECTION 3 — 线框三视图 + 细节微距特写
SECTION 4 — 尺寸标注三视图
SECTION 5 — 爆炸图/内部结构
SECTION 6 — 材质色板 + 物料清单
```
### 第四步:审计验证
每写完一个资产,对照母版检查清单逐项确认:
```
⬜ 背景色/纹理正确(对应变体)
⬜ 主视觉描述完整(角度/光线/材质)
⬜ 三视图存在(角色必选,道具视变体)
⬜ 表情组/细节模块 ≥ 4个
⬜ 配色方案(色块标注,≥5个色名)
⬜ 模块命名规范(MODULE A/B/C…双语文档)
⬜ 整体比例(横版 16:9)
```
✅ **完整度标准**:每项资产必须覆盖母版要求的全部 SECTION,缺一段就是"不完整"。
### 三套母版文件
完整母版模板见 reference 文件:
- `references/角色定妆图提示词a版.md` — A1/A2/A3/A4 变体完整结构
- `references/场景设计图提示词a版.md` — S1/S2/S3/S4 变体完整结构
- `references/道具设计图提示词a版.md` — P1/P2/P3/P4 变体完整结构
- `references/infinite-canvas-llm-integration.md` — 无限画布 LLM 集成技术笔记(API 调用/表格渲染/边缘缩放/文件上传/边缘覆盖层方案)
每次使用前**必须**加载对应母版文件,逐段对照填写。
---
## 第二步:角色设计
### 定妆照生成
> 完整提示词请使用 **母版驱动资产提示词**(上一步1/2的 角色定妆图 流程),
> 严格按变体 A1/A2/A3/A4 的 SECTION 1/2/3 结构逐段填写。
> 定妆照使用 Flux 2 Klein 4B 生成角色各个角度、表情:
- 正脸、侧脸、3/4侧脸
- 喜怒哀乐各表情
- 全身/半身
- 各标志性服装
## 第三步:场景设计
> 完整场景提示词请使用 **母版驱动资产提示词**(上一步1/2的 场景设计图 流程),
> 严格按变体 S1/S2/S3/S4 的 SECTION 结构逐段填写。
> 下方为简要实践对照。
## 第四步:漫剧分镜(关键)
### 与普通分镜的区别
```
普通分镜:拍什么 → 运镜怎么走 → 演员怎么动
漫剧分镜:关键pose → 镜头怎么动(数字运镜) → 转场方式
```
### 漫剧镜头类型
| 镜头类型 | 实现方式 | 适用场景 |
|---------|---------|---------|
| 静态卡 | 直接显示完整画面 | 重要对话/情感时刻 |
| 推镜 | 从远景→特写(后期缩放关键帧) | 情绪递进、悬念 |
| 拉镜 | 从特写→远景 | 揭秘、转场 |
| 横移/摇镜 | 平移/旋转画面 | 场景展示、跟踪对话 |
| 快切 | 快速切换2-3张图 | 动作场面、冲突 |
| 分屏 | 同屏显示两个画面 | 对比/对话 |
| 淡入淡出 | 透明度过渡 | 转场 |
### 数字运镜参数参考
```
推镜:scale 100% → 120-150%,center保持人物面部
拉镜:scale 120% → 80-100%
横移:position x轴移动10-20%
摇镜:rotation 0→5度
时长:每个镜头1.5-3秒
过渡:0.2-0.5秒
```
## 第五步:关键帧生成
### 单集帧数计算
```
一集90秒漫剧 ≈ 30-50个关键帧
- 对话场景:每3-5秒一帧
- 动作场景:每1-2秒一帧
- 情感时刻:单帧停留3-5秒+运镜
```
### 生成流程
1. 准备角色定妆照(用于保持角色一致性)
2. 使用 ai-storyboard-artist skill 生成分镜prompt
3. 使用ComfyUI + Flux 2 Klein 4B批量生成关键帧
4. 风格LoRA选择:
- 2D国漫风 → loading anime风格LoRA
- 2D日漫风 → loading koni_animestyle等
- 3D风格 → 用prompt驱动
5. IP-Adapter/PuLID保持角色面部一致性
## 第六步:配音与音频
### AI配音流程
```
剧本 → 分角色台词提取 → TTS生成各角色声音 → 对齐时间线 → 混音
```
### 建议工具
| 工具 | 用途 | 国内替代 |
|------|------|---------|
| Edge-TTS | 免费多语言TTS | 阿里云语音合成 |
| ElevenLabs | 高质量多角色TTS | 火山引擎TTS |
| Fish Audio | 角色语音克隆 | 出门问问 |
| Suno/Udio | BGM生成 | 天工音乐 |
## 第七步:后期合成
### 推荐剪辑工具
| 工具 | 用途 | 适合 |
|------|------|------|
| 剪映/CapCut | 全流程剪辑 | 新手、快速出片 |
| After Effects | 高级运镜特效 | 专业制作 |
| DaVinci Resolve | 调色+剪辑 | 高质量出片 |
### 剪映工作流
```
1. 导入所有关键帧图片(按顺序排列)
2. 每张图设置1.5-3秒时长
3. 对关键帧添加关键帧动画(缩放+位移=数字运镜)
4. 添加转场(淡入淡出/模糊/闪白)
5. 导入配音音频,对齐画面
6. 添加背景音乐(音量比配音低6-10dB)
7. 添加音效(脚步声、开门声、打击声等)
8. 调色(统一色调)
9. 添加字幕(自动识别配音生成)
10. 导出(1080x1920, 30fps, H.264)
```
### 运镜关键帧动画教程(剪映)
```
推镜效果:
1. 选中图片素材
2. 开头打关键帧:缩放100%
3. 结尾打关键帧:缩放120%
4. 自动生成推镜动画
横移效果:
1. 选中图片素材
2. 开头打关键帧:位置(0,0)
3. 结尾打关键帧:位置(-200,0)
4. 自动生成横移动画
```
## 输出规范
### 文件结构
```
comic-drama/{project-name}/
├── script/ # 剧本
├── characters/ # 角色设定+定妆照
├── backgrounds/ # 背景图
├── storyboard/ # 分镜
├── frames/ # 关键帧
├── audio/ # 配音/BGM/音效
└── output/ # 成片
```
### 成片参数
```
分辨率:1080x1920 (9:16 竖屏)
帧率:30fps
编码:H.264
音频:AAC 320kbps
时长:60-120秒/集
```
## 常见问题排查
### AI 文本模型输出异常:提示词已生成但无法写入
**现象**:参考图提示词/参考视频提示词在日志中有内容,但实际没有写入数据库,报 `Updated 0/N shots`。
**根因排查步骤**:
```
1. 查后端日志 → 找 [GenerateRefPrompts] / [GenerateKeyframePrompts] 标记
2. 看错误类型:
- "Invalid JSON after repair" → LLM 返回的 JSON 格式错误(缺逗号/重复/错位)
- "shot N missing from LLM output" → LLM 输出缺少这个镜头的条目
- "TypeError: Illegal invocation" → JS 函数 this 上下文丢失(代码 bug)
3. 查 global-model-config.json 中 text.modelId
```
**最常见原因**:文本模型能力不足以生成严格结构化 JSON 输出。
**修复方案(按推荐程度排序)**:
| 方案 | 操作 | 效果 |
|------|------|------|
| 升级模型 | `modelId` 从 `qwen-plus` 改为 `qwen-max` | 最强结构化能力 |
| 换模型系列 | 改用 `deepseek-chat`(DashScope 也支持) | 结构化输出稳定 |
| 降批量 | 每批从 8 个镜头改为 4 个 | 减少 LLM 输出压力(需改源码) |
| 重试 | 重新点生成,有时偶发性失败 | 不稳定 |
**配置文件位置**:`{project}/app/data/global-model-config.json`
**参考日志关键字**:`GenerateRefPrompts`, `GenerateKeyframePrompts`, `invalid JSON array shape`, `missing from LLM output`
详细调试记录见 `references/ai-text-json-failure.md`。
## 参考技能
- short-drama-scriptwriting → 剧本
- ai-storyboard-artist → 分镜与prompt
- comfyui → Flux/图像生成
- sound-design-film → 音效设计
- tvc-director → 视觉调性参考
Attribution
Comments
Loading comments…