Skip to content
Back to skills

Storyboard Gen

ASecurity

分镜剧本输出格式样板 v6(最终沉淀版)。 本文件是 storyboard-gen skill 的输出格式权威定义——直接照抄即可。

  • 2 stars
  • 0 votes
  • 0 copies
  • 0 views
  • Added October 6, 2026
ai-agentssqlapi

Works with

  • api

Security analysis

A100/100

Scanned October 6, 2026

npx -y skills add Kairos-ai-agent/kairos-code --skill storyboard-gen --agent claude-code

Installs into .claude/skills of the current project.

Are you the author of Storyboard Gen?

Add the live security badge to your README. It updates with every re-scan.

Security grade badge for Storyboard Gen
[![Security: A — Skills Directory](https://www.skillsdirectory.com/api/skills/kairos-ai-agent-storyboard-gen/badge)](https://www.skillsdirectory.com/skills/kairos-ai-agent-storyboard-gen)

More formats (shields.io, HTML) on the badges page. Keep it an A: scan every change in CI with Pro.

Download with Pro
SKILL.md
---
name: "storyboard-gen"
description: "分镜剧本输出格式样板 v6(最终沉淀版)。 本文件是 storyboard-gen skill 的输出格式权威定义——直接照抄即可。"
priority: 0.5
imported-from: "hermes"
source-path: "hermes/skills/storyboard-gen/SKILL.md"
---
## 集成到 AI 视频流水线 (v6 → 视频模型)

当 v6 输出被自动化 agent 直接喂给 AI 视频模型时(如 aigc agent 的自动分镜 → 图生视频),按以下原则集成:

- **语义映射**: agent 的 storyboard = v6 的 shot(一对一,每个 storyboard 产一个视频);不引入 SEG 实体。v6 的 SEG 级调度 4 字段在每个 shot 里按需填充 agent 视角的子集;v6 "跨 SEG 资产互引" 改为单字段 `passes_to_next`(仅描述下一镜头起始基线即可,承接上镜可由 agent 从 idx-1 自动推断)
- **prompt 优先级**: v6 元数据自动拼装的英文 prompt > LLM 自由撰写的 `video_prompt`。v6 的摄影机/构图/时间锚定 acting/intent 是工艺级输入,比一句 "Cinematic 16:9 shot..." 精确得多
- **一次性输出**: agent 是自动分镜(无人工事后审查),必须让 LLM 在分镜生成时一次性输出所有 v6 字段 + video_prompt。不要拆成多次往返 — 延迟爆炸 + 字段不一致
- **持久化建议**: 时间锚定字段(acting/sound)用 JSON 字符串存 SQLite TEXT;展示时 JSON parse 还原为数组
# 集成到白模预览(v6 → 3D previs)

v6 → `storyboard-previs` skill 是**零成本验证关卡**,建议在 AI 视频生成之前插入:

- 用 Three.js + LLM 解析把 v6 转成 3D 白模镜头预览(不烧 GPU)
- 验证镜头运动是否合理(焦距/机位/演员走位)
- 验证 SEG 时长、节奏、转场衔接
- 客户/团队 review 可视化材料(比 markdown 直观 10 倍)

**触发场景**:
- 客户想先看分镜节奏再决定要不要进入 AI 视频生成
- 自动分镜完成后、人工 review 前
- 编辑师需要镜头预览做剪辑参考

**关键差异**(vs 直接喂 AI 视频):
- 不消耗 GPU / 视频生成 token
- 5 分钟改完全部分镜(vs 视频模型改不动)
- 输出是 webm 白模(vs 真实风格视频)

详见 `storyboard-previs` skill 的 SKILL.md / references/v6-field-mapping.md。

---

# Integration Patterns: v6 → AI 视频流水线

把 storyboard-gen v6 的分镜剧本元数据,集成到自动化 AI 视频生成流水线(如 aigc agent 的自动分镜 → 图生视频)的可复用模式。所有代码示例都来自 aigc agent 实际生产集成(2026-08)。

> **本文件聚焦"模式 / schema / sanitize / compose / 集成踩坑"。**
> Agnes Video V2.0 的 HTTP/字段层面约束(localhost ban、wire 字段名、polling 响应形状、HTTP 失败码、standard preset 表、duration_to_num_frames 算法等)见 `references/ag-video-api-quirks.md`。
> 那里覆盖的是"调 API 时什么会 400"——本文件不重复。

--

## 文件结构(按职能角色组织 references/)

> **核心定位**:本 skill 是 `编剧 + 导演 + 分镜师` 三位一体的端到端工作流。
> 输入:小说 / 普通剧本 → 输出:专业分镜剧本

**编剧层**(输入处理 · 剧本优化)
  references/novel-pipeline.md     → 小说 → 标准化剧本
  references/script-optimization.md → 8 维度剧本优化(结构/情节/节奏/角色/对白/场景/伏笔/主题)
  references/long-input-processing.md → 长输入分批策略(5 级规模)

**导演层**(设计决策 · 审查修订 · S 级水准)
  references/director-workflow.md  → 端到端 6 阶段流水线(决策书 / SEG 划分 / 镜头细写 / 体检报告 / 二轮修订)
  references/s-grade-craft.md      → S 级专业水准(黄金3s / 强冲突开局 / 钩子设定 / 全剧锚点系统 / Save the Cat 15 节拍 / S 级评分 10 维度)

**分镜层**(核心执行 · 工艺细节)
  references/sop.md                → 5 阶段 SOP(含分镜工艺)
  references/template.md           → 输出样板(SEG 头/镜头/退出状态/衔接检查/故事衔接检查)
  references/acting-anatomy.md     → 表演细节(关节级/呼吸/肌肉张力)
  references/shot-craft.md         → 视觉工艺(轴线/视线/景深/构图/光线/调色/镜头运动)
  references/sound-design.md       → 声音设计(声场层次/声道定位/声学环境/Foley/音乐)
  references/qc-checklist.md       → 4 段质检清单(镜头级/SEG级/跨SEG级/红旗)

**长篇支持层**(按需加载 · 适用于多 SEG 长片)
  references/layered-structure.md  → Act→Chapter→Scene→SEG→Shot 多层架构
  references/asset-library.md      → 角色/场景/物件/风格母题库(跨 SEG 资产复用)

**集成层**(当分镜剧本要喂给视频生成 API 时)
  references/integration-patterns.md → v6 → aigc agent 集成模式(语义映射 / schema 迁移 / sanitize / compose / prompt 设计 / 集成踩坑)
  references/ag-video-api-quirks.md → Agnes Video V2.0 API 的所有经验坑(localhost URL 禁、num_frames 8n+1 + per-reso cap、1080p clamp、wire 字段名、base64 必备、polling 响应形状、HTTP 失败码表)

**外部参考与差距分析层**(维护本 skill 时加载 · 与同领域外部 skill 的对比与待落地内容)
  references/director-gap-analysis-2026-08.md → 与 s1dashu/director 的 9 项差距 + A/B/C 类优先级 + A 类内容草稿(声音表演维度 / AI 视频模型人物参考图工作流 / style 锁与场景分离元规则)

**使用顺序**:编剧层(输入)→ 导演层(设计+审查)→ 分镜层(执行)→ 长篇支持(按需)
**短片项目**:可跳过 long-input-processing.md 和 layered-structure.md
**长片项目**:加载全部 references
**集成到 AI 视频流水线**:额外加载 references/integration-patterns.md + references/ag-video-api-quirks.md
**维护时**:加载 外部参考与差距分析层,落地 A/B/C 类条目

---

# 输出格式样板 v6(最终沉淀版)

**直接照抄这个结构**——这是交付物的标准形态。

**v6 在 v5 基础上新增 3 类必填字段**(加强包 A/B/C):
- SEG 级调度 4 字段(演员走位 / 灯光调度 / 道具调度 / 转场规划)
- 镜头级【意图】字段(说明镜头服务于张力/潜文本/POV/母题 哪个)
- 跨 SEG 资产互引 2 字段(承接上 SEG 资产 / 传递给下 SEG 资产)
详见下文"v6 vs v5 关键差异速查"节。

## 模板 A:SEG 头(每个 SEG 的开头)

```markdown
# SEG{N}|{一句话主题}|总时长{X}秒

【匹配资产|使用画布资产名称,不使用源文件名】  
角色:{角色1}|{角色2}|{角色3}  
场景:{场景名}  

**本段唯一剧情动作:**{一句话描述这段 SEG 要传达的核心事件。一件事,一句话,不并列。}  
**表演组:**{关键身体动作序列,用分号分隔}。  
**对白:**{N}句。  
**主特效:**{本 SEG 需要的视觉特效列表}。

【SEG 级调度|真人拍摄需要的全景信息】
**演员走位:**{谁从 A 点到 B 点,路径,关键停顿点}。
**灯光调度:**{开 SEG 时灯光状态 → 收 SEG 时灯光状态(色温/方向/硬度)}。
**道具调度:**{关键物件从哪到哪,谁交接,状态变化}。
**转场规划:**{出 SEG 用什么方式进下一 SEG:声音桥 / 视觉引导 / 黑场 / 匹配剪辑}。

【跨 SEG 资产互引|防止资产走样】
**承接上 SEG 资产:**{SEG{N-1} 退出时的关键资产 X,本 SEG 起始状态是否保持一致——若不一致需镜头交代变化}。
**传递给下 SEG 资产:**{本 SEG 退出的关键资产 X,SEG{N+1} 是否需要承接——列出待办}。
```

**示例**:
```markdown
# SEG01|旧书摊的傍晚|总时长12秒

【匹配资产|使用画布资产名称,不使用源文件名】  
角色:林深  
场景:旧书摊所在巷口(傍晚)

**本段唯一剧情动作:**林深抵达巷口,开始一天的书摊日常。  
**表演组:**推车抵达巷口;摆书整齐码好;坐下抿茶;望巷口。  
**对白:**0句。  
**主特效:**暮色降临(蓝紫→暖橙);路灯渐次亮起(暖黄)。
```

---

## 模板 B:镜头(每个镜头的开头)

```markdown
## 镜头{N}|{X}秒|{一句话镜头描述}

【镜头级资产】{列出本镜头用到的资产,用正式名}  
【摄影机】{焦距}毫米,{机位高度/位置},{距主体距离},{固定/运动}。  
【画面】{构图描述——主体位置/占比},{主体动作轨迹},{环境元素}。  
【基线】{开拍时的姿态/位置/视线方向}。  
【表演】开拍X.X秒,{动作描述};开拍X.X秒,{动作描述};...(按时间顺序自然描述,不用"前-中-后"分点)  
{如有对白}  
【{角色}同期|对白约{X}秒】{语气/节奏/字数/重音/句尾描述}:{对白内容}  
【声音】开拍X.X秒,{声音1};开拍X.X秒,{声音2};...(自然语言描述,不分前景/中景/背景)  
【意图】{这一秒/这一镜为什么这样设计——服务于【张力曲线】【潜文本】【POV/信息释放】【母题变奏】中的哪一个;用一句话说清镜头存在的理由}。
```

### 【摄影机】字段示例(只写 4 项):
- `【摄影机】85毫米,胸口高度,母亲正前方约1米,固定机位。`
- `【摄影机】50毫米,胸口高度,姬轩右前方约2米,固定机位。`
- `【摄影机】35毫米,胸口高度(略仰角),距推车约5米,固定机位。`

### 【对白】字段示例(单字段,不用引用块):
- `【幼童同期|对白约2.5秒】近景可见喙部;低音量气声,每两至三个字换气0.3秒,末字音量减半:母亲……太阳还会回来吗?`
- `【林深同期|对白约2.0秒】低音量气声,单次呼气,重音落在"翻一翻",句尾下沉(暗示"不是真的需要买"):你很喜欢这本书吗?想看的话,可以拿去翻一翻,不用买。`

### 【声音】字段示例(自然语言描述,不分前景/中景/背景):
- `【声音】风啸持续约2秒;火苗熄灭时响起一声短促熄火声;间隔0.2秒,低频心跳落下一记。`
- `【声音】开拍0.0秒,环境音降至低频底噪;开拍3.0秒,心跳落下一记(与最后一次呼吸同步);开拍3.0-3.8秒,留白0.8秒(仅有底噪);开拍5.0秒,母亲短促吸气声;开拍5.3秒,母亲喉部压低气声0.3秒。`

### 【表演】字段示例(按时间顺序自然描述,不用"前-中-后"分点):
- 旧格式(错误):分"前兆/主体/余韵"三段
- 新格式(正确):单段连续描述
```
开拍0.0秒,念念默默站着(肩膀微微下沉——不开心的身体语言);
开拍0.5秒,念念低头(视线锁定地面——不是盯书);
开拍1.0秒,念念小手紧紧攥着衣角(比 SEG02 更紧——不是犹豫,是克制悲伤);
开拍2.0秒,念念肩膀微微颤抖(细微的颤动——压抑的哭泣前兆);
开拍3.0秒,念念依旧没有抬头(沉默——准备说出难以启齿的话)。
```

---

## 模板 C:SEG 结束状态(每个 SEG 的结尾)

```markdown
## SEG{N} 退出状态

- {资产1的精确状态——姿态、位置、归属}
- {资产2的精确状态}
- {资产3的精确状态}
- {环境状态——光、风、声音基调}
- {如有伏笔资产——说明状态、是否被镜头捕捉}
- SEG{N+1}以{进入方式}接入,{景别/对象变化}。
```

---

## 模板 D:SEG{N} 上下衔接检查(每个 SEG 必填,**v5 新增必填**)

```markdown
## SEG{N} 上下衔接检查

### 与上一 SEG 衔接
- [x] 退出状态承接:{上一 SEG 的退出资产状态} → {本 SEG 进入时是否保持}
- [x] 视觉锚点延续:{光源/色温/构图方向是否一致}
- [x] 声音延续:{上一 SEG 尾音是否与本段起音衔接}
- [x] 关键伏笔承接(如有):{上一 SEG 埋的伏笔在本 SEG 是否承接}

### 与下一 SEG 衔接(前置规划)
- [x] 本 SEG 退出状态已精确到 {姿态/位置/视线/呼吸/肌肉} ✓
- [x] 为下一 SEG 提供的进入条件:{景别/对象/方向/声音桥}
- [x] 视觉锚点向下传递:{下一 SEG 的视觉承接点}

### SEG{N} 内自检
- [x] 摄影机参数完整(焦距+机位+距离+运动,**仅 4 项**)✓
- [x] 表演到关节级 + 时间锚 ✓
- [x] 对白 4 维度(字数+节奏+重音+句尾)✓
- [x] 声音有时间锚 + 自然语言描述 ✓
- [x] SEG 时长 ≤15 秒 ✓
- [x] "拍摄" 词残留检查:0 处 ✓
- [x] 【SEG 级调度】4 字段齐全(演员走位 / 灯光调度 / 道具调度 / 转场规划)✓(v6 新增)
- [x] 【跨 SEG 资产互引】2 字段齐全(承接上 SEG 资产 / 传递给下 SEG 资产)✓(v6 新增)
- [x] 每个镜头含【意图】字段 ✓(v6 新增)
```

**示例**:
```markdown
## SEG01 上下衔接检查

### 与上一 SEG 衔接
- 上一 SEG:无(SEG01 是开场 SEG)

### 与下一 SEG 衔接(前置规划)
- [x] 本 SEG 退出状态已精确到**姿态(坐姿)/ 位置(巷口老位置)/ 视线(望向巷口)/ 表情(疲惫+孤独)** ✓
- [x] 为下一 SEG 提供的进入条件:**巷口位置 + 路灯已亮 + 推车停稳 + 推车最外侧是《小王子》**(这是 SEG02 念念盯书的视觉前提)
- [x] 视觉锚点向下传递:**暖黄路灯(3000K)+ 巷口梧桐树 + 暮色调**——这三项从 SEG01 开始向下传递到 SEG12

### SEG01 内自检
- [x] 摄影机参数完整(焦距+机位+距离+运动)✓
- [x] 表演到关节级 + 时间锚 ✓
- [x] 对白 4 维度(0 句对白)✓
- [x] 声音有时间锚 + 自然语言描述 ✓
```

---

## 模板 E:故事衔接检查(最终 SEG 后必填,**v5 新增必填**)

```markdown
## 故事衔接检查

### 1. 整条 SEG 链连贯性
- [ ] SEG01 → SEG02:{承接内容}
- [ ] SEG02 → SEG03:{承接内容}
- ...(逐 SEG 衔接检查)
- [ ] 跨 SEG 资产链:{角色/物件/场景的连续性}

### 2. 情绪曲线合理性
- [ ] 开 SEG 基调:{基调}
- [ ] 中段转折:{转折}
- [ ] 高潮位置:{高潮 SEG}
- [ ] 收尾收束:{收尾 SEG}

### 3. 主题贯穿
- [ ] 主题母题贯穿:{物件母题/视觉母题/声音母题/对白母题}
- [ ] 主题台词落地:{在哪几个 SEG 出现主题台词}

### 4. 伏笔完整性
- [ ] 全部伏笔埋设:{数量}
- [ ] 全部伏笔回收:{数量}

### 5. 调色/光线一致性
- [ ] 全片主色调:{主色调}
- [ ] 跨 SEG 色温变化:{各阶段色温}
- [ ] 变化有叙事理由:{场景变化/时间变化/情绪变化}

### 6. 节奏控制
- [ ] 单 SEG 时长 ≤15 秒:{全部满足}
- [ ] 高潮 SEG 时长:{时长}
- [ ] 节奏呼吸点:{较短 SEG}

### 7. 资产复用与差异
- [ ] 主要角色弧线:{角色变化}
- [ ] 核心物件演变:{物件状态变化}
- [ ] 声音母题演变:{声音变化}
```

---

## 格式硬规则(13 条)

1. **每个 SEG 必须有头 + 至少 1 个镜头 + 边界 + 上下衔接检查**(v5 新增)
2. **每个镜头必须包含 8 要素**(缺一项即不合格,v6 从 7 升级为 8):【镜头级资产】【摄影机】【画面】【基线】【表演】【对白(如有)】【声音】【意图】
3. **所有时间用"开拍 X.X 秒"格式**——不用"开始时""中段""最后"
4. **资产名沿用原文 + 资产正式名**——不二次创造新名字
5. **【对白】用单字段格式**——格式:`【角色同期|对白约X秒】{描述}:{内容}`(不用引用块)
6. **【声音】用自然语言描述**——不按"前景/中景/背景"分层
7. **单 SEG 时长 ≤15 秒**(硬约束)
8. **【摄影机】只写 4 项基础信息**——不写景深档位、俯仰角度、构图法则

**v5 新增必填规则**:
9. **每个 SEG 必须含"SEG{N} 上下衔接检查"**
10. **最终 SEG 后必须含"故事衔接检查"**

| **v6 新增必填规则**(真人可拍、跨 SEG 不走样):
11. **每个 SEG 必须含【SEG 级调度】4 字段**(演员走位 / 灯光调度 / 道具调度 / 转场规划)——真人拍摄需要 SEG 全景图,不是镜头碎片
12. **每个镜头必须含【意图】字段**——说明镜头服务于【张力曲线】【潜文本】【POV/信息释放】【母题变奏】中的哪一个——团队协作时不用问"为什么这样拍"
13. **每个 SEG 必须含【跨 SEG 资产互引】2 字段**(承接上 SEG 资产 / 传递给下 SEG 资产)——长篇防止资产走样(角色突然换衣服/换物件)

---

## v6+ 元规则(5 条上层原则)

下面 5 条不是字段格式,而是**贯穿所有字段的元规则**。任何字段填写都必须符合这 5 条;违反任意一条即视为不合格。

### 元规则 1:style 锁与具体场景分离

**style 锁只描述全片持续不变的视觉语言**(媒介、写实程度、人物比例、材质、线条、色彩、光影、渲染体系、摄影基调)。**不固定**具体地点、天气、服装、动作或镜头——这些由当前资产或片段单独定义。

**应用到字段**:
- 【SEG 级调度·灯光调度】和【画面】可以写"暖黄路灯 3000K",但**不能**写"cinematic 3D 写实风格"——后者是 style 锁范畴,应在决策书顶层定义一次
- 【匹配资产】用资产正式名(已在 style 锁下生成过的版本),不是用风格描述代替

**反模式**:在镜头里反复重复"电影感 3D 写实风格、半写实人物比例、柔和高光"——style 锁是上游规则,不应渗透到每个镜头。

### 元规则 2:片段自包含(禁止"承接上 SEG"省略)

每个 SEG 必须自包含地定义**当前 SEG 实际可见的所有资产和开场状态**。禁止以下省略写法:
- ❌ "承接上一片段" / "保持前面造型" / "延续 SEG03 的状态"
- ❌ "如 SEG05 所示" / "见 SEG02"
- ✅ 当前 SEG 起始:姿态 X、位置 Y、视线 Z、情绪 W、声音 V——逐项重述

**应用到字段**:
- 【基线】字段必须重述开拍时的姿态/位置/视线——不能省略说"承接上 SEG"
- 【匹配资产】字段必须列出本 SEG 实际出现的资产,不省略说"继承自 SEG05"
- 即使与上一 SEG 资产完全相同,也要在本 SEG 字面重写一次

**反模式**:在长篇项目里靠"承接"省事 = 中段开始资产漂移。

### 元规则 3:参考媒体优先于旧文字(冲突解决原则)

当已确认的参考媒体(资产图、音色、场景图)与剧本 / Prompt 中的旧文字描述冲突时:

1. **以参考媒体为准**——用户确认过的视觉/声音身份是最高优先级
2. **同步改写文字**——把与参考媒体冲突的文字描述改成一致
3. **保留旧版本用于溯源**——不删除,仅标注为"已修订"
4. **冲突影响剧情时停止**——若改写会改变角色身份、剧情机制或角色含义,停止并请用户裁决,不静默提交互相矛盾的素材和文字

**反模式**:一边连接参考图一边要求生成另一种性别 / 物种 / 服装 / 画风。

### 元规则 4:15 秒对白容量上限

每个 SEG 的对白容量受 15 秒硬约束限制:

| 类型 | 容量上限 | 超限处理 |
|------|----------|----------|
| 单人连续对白 | 约 50-55 个汉字 | 增加 SEG,不加速朗读 |
| 多人轮换对白 | 每人不超过 3 句,每句 < 15 字 | 拆分 SEG,不加快语速硬塞 |
| 对白 + 动作混合 | 单一对白 < 20 字 + 留出 0.5-1 秒动作空间 | 优先动作时删对白,优先对白时减动作 |

**反模式**:15 秒内塞 3 个角色 + 6 句台词 + 2 个动作转折 = 全部模糊。

完整的声音维度速查和声音表演自检见 `references/acting-anatomy.md` 十二节。

### 元规则 5:当前权威资产清单是唯一入口

任何 SEG / 镜头 / 修订都必须从 `asset-library.md` 顶部的"当前权威资产清单"解析资产,**不能靠目录里"看起来最新"的文件猜测**。完整的状态机和变更流程见 `references/director-workflow.md` 1.8 节。

**反模式**:SEG 引用了"林深 V3"但清单只到 V2 = 引用了未登记资产,下游生成失败。

---

## 跨 SEG 的格式约定

- SEG 编号两位数:`SEG01`, `SEG02`, `SEG03`...
- 镜头编号:`镜头01`, `镜头02`...(在 SEG 内从 01 重新开始)
- 总时长 = 镜头时长之和(允许 ±0.5 秒误差)
- 总时长和镜头时长关系:`SEG总时长 = Σ镜头时长 - 重叠时长(声音桥等)`

---

## 摄影机信息详细规范

### 保留的 4 项基础信息

| 项目 | 格式 | 示例 |
|------|------|------|
| 焦距 | `{数字}毫米` | 85毫米 |
| 机位高度/位置 | 自然描述 | 胸口高度 / 俯视角度 / 距冰面20厘米 |
| 距主体距离 | `{距离}` | 约1米 / 约2米 / 约30厘米 |
| 运动 | `{运动方式}` | 固定机位 / 横移 / 推 / 拉 / 跟 |

### 不写的内容(用户多轮反馈删除)

| 项目 | 原示例 | 不写的原因 |
|------|--------|----------|
| 景深档位 | `f/2.0 极浅景深` | 用户反馈:"去掉所谓拍摄的话术" |
| 俯仰角度数值 | `俯角10°` | 同上 |
| 水平角度 | `3/4 侧` | 同上 |
| 构图法则术语 | `三分法` / `对称构图` / `引导线` / `留白` | 同上 |

### 替代方案

构图信息放进**【画面】**字段自然描述,不使用术语:
- ❌ `构图三分法(主体在右三分线)+ 大面积留白`
- ✅ `构图中心略偏右,左侧留出巷口的负空间`

光线信息也放进【画面】字段自然描述:
- ✅ `路灯渐次亮起(暖黄3000K),开始照亮林深面部一侧`

---

## v6 vs v5 关键差异速查

| 项目 | v5(旧) | v6(新) |
|------|---------|---------|
| 镜头要素数 | 7 要素 | **8 要素**(+【意图】) |
| SEG 头字段 | 6 项(角色/场景/动作/表演组/对白/主特效) | **6 项 +【SEG 级调度】4 字段 +【跨 SEG 资产互引】2 字段** = 12 项 |
| SEG 级"调度说明" | 无(只有镜头级 7 要素) | **4 字段**(演员走位/灯光调度/道具调度/转场规划) |
| 镜头"导演意图" | 无(只有工艺字段) | **1 字段**(【意图】说明镜头存在的理由) |
| 跨 SEG 资产链 | 靠 qc-checklist 跨 SEG 级人工检查 | **SEG 头强制互引 2 字段**(承接上 SEG / 传递给下 SEG) |
| 硬规则数 | 10 条 | **13 条** |

## v5 vs v4 关键差异速查

| 项目 | v4(旧) | v5(新) |
|------|---------|---------|
| SEG 标题 | `# SEG{N}|{主题}|总拍摄时长{X}秒` | `# SEG{N}|{主题}|总时长{X}秒` |
| 镜头标题 | `## 镜头{N}|拍摄{X}秒|{描述}` | `## 镜头{N}|{X}秒|{描述}` |
| SEG 结尾 | 只有"SEG{N} 退出状态" | "SEG{N} 退出状态" + **"SEG{N} 上下衔接检查"**(必填) |
| 最终 SEG 后 | 无 | **"故事衔接检查"**(必填) |
| "拍摄" 词 | 出现在 SEG 标题/镜头标题 | 全部去除(用户多轮明确反馈) |

## v4 vs v3 关键差异速查

| 项目 | v3(旧) | v4(新) |
|------|---------|---------|
| SEG 时长 | ≤30 秒 | ≤15 秒 |
| 摄影机字段 | 7 项(含景深档位/俯仰角度等) | 4 项(基础) |
| 镜头要素数 | 7 要素 | 7 要素(摄影机精简 + 对白单字段) |
| 对白格式 | `> {内容}` 引用块 | 单字段内联 |
| 声音格式 | 分前景/中景/背景 | 自然语言描述 |
| 输出模式 | 双输出(含 AI 视频) | 单输出(移除 AI 视频模式) |

Attribution

Is this your skill, or is something wrong with this listing? Request removal or report an issue. Author removals are honored within 72 hours.

Comments

Loading comments…