Back to skills
SKILL.md
Minimax H3 Prompt
ASecurityGenerate production-ready prompts for MiniMax H3 video generation (海螺 H3). Use when the user mentions \"MiniMax H3\", \"海螺 H3\", \"H3 模型\", \"hailuo H3\", \"h3 video\", or asks to write prompts for H3 video gen
- 2 stars
- 0 votes
- 0 copies
- 0 views
- Added October 6, 2026
Works with
Security analysis
100/100npx -y skills add Kairos-ai-agent/kairos-code --skill minimax-h3-prompt --agent claude-codeAre you the author of Minimax H3 Prompt?
Add the live security badge to your README. It updates with every re-scan.
[](https://www.skillsdirectory.com/skills/kairos-ai-agent-minimax-h3-prompt)---
name: "minimax-h3-prompt"
description: "Generate production-ready prompts for MiniMax H3 video generation (海螺 H3). Use when the user mentions \"MiniMax H3\", \"海螺 H3\", \"H3 模型\", \"hailuo H3\", \"h3 video\", or asks to write prompts for H3 video gen"
priority: 0.5
version: "1.0.0"
imported-from: "hermes"
source-path: "hermes/skills/software-development/gen-api-integration/references/minimax-h3-prompt/SKILL.md"
---
# MiniMax H3 视频提示词生成器
为 MiniMax H3(海螺 AI 多模态视频模型)生成可直接使用的中文/英文提示词。H3 强调"指令遵循 + 镜头拆解 + 素材角色标注",与 Seedance 2.0、Grok 等模型的提示词风格有明显差异。
---
## 整体公式(1.1)
```
完整提示词 = 参考素材说明 + 核心创意 + 画面过程说明
```
- 没有上传素材 → 参考素材说明整段跳过
- 顺序固定:先讲"用什么素材 + 讲什么故事",再讲"画面怎么动"
---
## 核心创意 · 七个必备要素(1.2)
用一段话锁定全片信息,必须覆盖:
| # | 要素 | 说明 |
|---|------|------|
| ① | 主体 | 谁/什么(人/物/动物/其他),多角色需指代清楚 |
| ② | 地点 | 在哪里(场景/环境) |
| ③ | 动作 | 在做什么(动态/变化) |
| ④ | 时间节奏 | 何时/多久(整体时长与节奏) |
| ⑤ | 镜头语言 | 景别 / 运镜 / 角度 |
| ⑥ | 风格氛围 | 写实 / 动画 / 科幻 / 复古 等 |
| ⑦ | 不想要 | 视频里**不要出现什么**(如"不要额外添加背景音乐") |
### 写作铁律
- **少写比喻句,多写看得见的画面** — H3 更擅长理解明确画面指令,不是抽象比喻
- **台词必须明确具体内容** — 不能写"她说了句话",要写"她说:'你来了,剑等你好久了。'"
- **不要的内容必须显式写出** — 想要排除背景音乐、字幕、水印时,必须写明
---
## 参考素材说明(1.2 延伸)
每个上传的素材都要标注"角色",否则 H3 不知道用素材干什么。
### 标注格式
```
@图片1 → 用途说明(锁定什么)
@视频1 → 用途说明(锁定什么)
@音频1 → 用途说明(锁定什么)
```
### 可用素材用途清单
| 用途标签 | 锁定内容 |
|----------|----------|
| 人物参考 | 脸/形象 |
| 物体参考 | 物体 |
| 场景参考 | 场景 |
| 关键帧 | 单帧(首帧/尾帧需明确) |
| 音色参考 | 音色 |
| 故事版 | 按故事版分镜生成镜头 |
| 风格参考 | 按图片风格生成类似风格 |
| 构图参考 | 按图片构图生成对应构图 |
| 音频复用 | 复用整段音频 |
| 音频部分复用 | 部分复用(某音轨/某时间段) |
| 动作参考 | 锁定动作 |
| 运镜参考 | 锁定运镜 |
| 视频编辑 | 对视频某内容增删改 |
### 示例
```
@图片1 提供了 xx 角色的形象(多个角色需指代清楚),
@视频2 提供了动作参考。
@音频1 作为目标视频的音频复刻素材,具体歌词是:"ABCDEFGHIJKLMN"。
```
---
## 镜头拆解(1.3)
H3 有基础分镜能力,对切镜点遵从较强。
### 台词与切镜
- 台词长短必须合乎 shot 长短逻辑 — 禁止"3 秒 shot 说一大段话"
- H3 支持跨 shot 台词(J-cut、L-cut)— 写清"一句台词跨了哪些 shot"即可触发
- shot 内说话:写清是哪个角色
- shot 外说话:写清"画外说话人"
- 画内外转化时显式标注,例如:
```
一个画外音响起说:Wake up Wake up。
之后切镜到一个中年妇女的近景,她是画外音的主人,
她继续说道:It's time to go to school!
```
### 切镜一致性保持
切镜时显式写出"切到什么景别 + 主体是哪个角色",有助于跨镜头一致性。
---
## ★ 三类模式生视频(1.4 — 核心差异)
### 模式 1:上传多模态素材融合(多模态参考)
同时上传:人物图 + 动作视频 + 场景图 + 音乐,每个素材标角色:
```
@图片1 → 人物参考(锁脸)
@视频1 → 动作参考(锁动作)
@音频1 → 节奏/情绪参考
```
**示例**:
```
@图片1 是人物参考(锁这位女子的脸),
@视频1 是动作参考(用里面的舞剑动作),
@音频1 是情绪参考(古风配乐)。
让这位女子在樱花庭院里按视频里的动作舞剑。
```
### 模式 2:上传图片生成视频(图生视频)
| 上传情况 | 写法要求 |
|----------|----------|
| 1 张图 | 说清楚是**首帧**(视频开头画面)还是**尾帧**(结尾画面) |
| 2 张图(首+尾帧) | H3 **不会自动加切镜**,只补两帧之间的动作、光影、声音 |
**示例**:
```
@图片1 是首帧参考图:女子持剑站在樱花树下。
让她从持剑起势到舞剑完毕,自然衔接,不要切镜。
```
### 模式 3:纯文字生成视频
不依赖任何参考素材,根据文字建立主体、场景、动作。
- 文字描述要更具体(主体外观 + 场景细节 + 动作描述都要写清)
- 多用分层写法:
```
大全景(交代空间)→ 中景(承载动作)→ 特写(强调细节)
```
**示例**:
```
写实自然纪录片风格,电影级真实光影。清晨的薄雾中,
在广阔的湿地芦苇荡里,一只优雅的白鹤单腿站立在浅水中,
缓慢转头看向镜头。柔和的逆光,雾气在光束里飘动。
```
---
## 黄金模板(综合三类)
```
[素材段 - 仅在上传素材时写]
@图片1 是 xxx 参考(用途),@视频2 是 xxx 参考。
[核心创意段 - 必须]
主体 + 地点 + 动作 + 时间节奏 + 镜头语言 + 风格氛围 + 不要的内容
[分镜段 - 按时间码逐镜]
0-3 秒:[景别],[主体],[动作],[镜头运动],[台词/声音]
3-8 秒:[景别],[主体],[动作],[镜头运动],[台词/声音]
...
非叙事性音乐:[BPM / 情绪 / N/A]
```
### 完整示范(首尾帧模式)
```
@图片1 是首帧参考图:女子持剑站在樱花树下。
写实风格,电影级光影。0-3 秒:全景,女子从画面左侧缓步走入
樱花庭院,背景虚化,没有对白,只有脚步声。
3-8 秒:切镜到女子的中景,她拔出长剑,缓缓起势,
樱花瓣从树上飘落。镜头推进。
8-12 秒:切镜到特写,剑光一闪,慢动作,樱花被剑气激得四散。
非叙事性音乐:N/A。
```
---
## 容易踩的坑(1.5)
| 常见问题 | 怎么改 |
|----------|--------|
| 只写一段话没分段 | 按 3 段公式(素材 + 创意 + 过程)拆开写 |
| 写了"她说了句话" | 必须给出具体台词原文 |
| 默认要背景音乐 | 不需要时显式写"不要额外添加背景音乐" |
| 用了比喻/抽象描述 | 改为可视化的具体画面描述 |
| 2 张图以为会自动切镜 | H3 不会加切镜,需在分镜段显式说明 |
---
## 与其他模型的差异速查
| 特性 | MiniMax H3 | Seedance 2.0 | Grok Imagine |
|------|------------|--------------|--------------|
| @素材角色标注 | **必须**显式 | 可选 | 不使用 |
| 首尾帧模式切镜 | **不自动加** | 自动 | 自动 |
| 多模态联合参考 | 原生支持 | 支持 | 不支持 |
| 音频复用 | 支持(@音频N) | 支持(@音频N) | 原生合成 |
| 镜头语言 | 标准电影术语 | 四维编码 (Z/Y/X/F) | 标准电影术语 |
---
## 触发场景
- 用户说"用 H3 写个视频提示词"
- 用户提到"海螺 H3"、"MiniMax H3"、"hailuo H3"
- 用户提供 H3 输出的失败案例请求优化
- 用户希望把 Seedance/Grok 的提示词迁移到 H3 平台
Attribution
Comments
Loading comments…