| name | avd/storyboard |
| description | 【AI视觉导演】故事板/全案板/分镜图 — 全案板/分镜图/漫画页/情绪板/台词脚本/音效表。支持续写和多版本 |
Storyboard — 快速故事板
治理:走 engines/command-gate.md 权限表 §四 /avd/storyboard。产出标记 draft,不写回主状态。禁止重设角色DNA/重设场景核心。详见 rules/format-contract.md §1.3。
粘贴任意故事片段,AI 自动提取信息 → 智能推荐最佳风格+格式 → 输出可直接复制使用的 image prompt。
触发方式
/avd/storyboard [你的故事]
- 直接说 "故事板"、"分镜"、"帮我做这个故事板"
- 粘贴故事内容即可自动触发
⚠️ 路由规则(必须遵守)
不同用户意图走不同路径,不能所有情况都跑 13 步流水线。
| 用户说法 | 路由 | 输出内容 |
|---|
/avd/storyboard 全案板 | 直接生成全案板图 | AI 选 LS1-LS4/LS14-LS16,templates/full-board.md |
/avd/storyboard 分镜图 | 直接生成分镜图 | AI 选 LS5/LS6/LS7,templates/quick-board.md |
/avd/storyboard 全能版 | 直接生成全能版图 | AI 选 LS14/LS16/LS15 |
/avd/storyboard 漫画页 | 漫画分镜页 | templates/manga-page.md,多格漫画+对白气泡(给人看,不是AI视频施工指令) |
/avd/storyboard 情绪板 | 情绪板 | templates/mood-board.md,色彩/材质/氛围参考 |
/avd/storyboard 台词脚本 | 台词脚本 | templates/dialogue-script.md,角色×台词×节奏 |
/avd/storyboard 音效表 | 音效设计表 | templates/sound-design-sheet.md,镜号×音效类型×SD编号 |
/avd/storyboard 续写 / /avd/storyboard 下一段 | 续写故事板 | engines/series.md,继承DNA+尾帧锚定 |
/avd/storyboard 多版本 | A/B/C 三版本对比 | engines/multi-version.md |
/avd/storyboard 看全部 | 53种风格全览 | engines/styles.md |
/avd/storyboard 一键全平台 | GPT Image + MJ + SD 三平台 | 同内容三平台 Prompt |
/avd/storyboard [故事] | 轻量入口 | 识别+时长+3方向推荐 |
/avd/storyboard 一键生成 [故事] | 完整流水线 | 11模块全案板 + 视频 Prompt |
⚠️ /avd/storyboard 无参数 = 展示全部路由
用户只输入 /avd/storyboard 不传参数时,必须展示完整路由选单,让用户选。不能只拣几条、不能猜用户意图。
| 编号 | 说 | 走 |
|---|
| 1 | 全案板 | 1张 5模块导演总览,LS1-LS4 |
| 2 | 分镜图 | N张纯镜头序列(每张≤4帧),LS5/LS6/LS7 |
| 3 | 全能版 | 一张图锁全部,LS14/LS15/LS16 |
| 4 | 漫画页 | 多格漫画+对白气泡 |
| 5 | 情绪板 | 色彩/材质/氛围参考 |
| 6 | 台词脚本 | 角色×台词×节奏 |
| 7 | 音效表 | 镜号×音效类型×SD编号 |
| 8 | 续写 / 下一段 | 继承DNA+尾帧锚定 |
| 9 | 多版本 | A/B/C 三版本对比 |
| 10 | 看全部 | 53种风格全览 |
| 11 | 一键全平台 | GPT Image + MJ + SD 三平台 |
| 12 | 一键生成 [故事] | 11模块完整包 |
| 13 | [粘贴故事] | 我识别后推荐 3 个方向 |
多画幅适配(全局)
| 命令 | 效果 |
|---|
适配小红书 / 适配抖音 | 9:16 竖版 |
适配B站 / 适配朋友圈 | 16:9 / 1:1 |
适配所有平台 | 自动切换全部画幅 |
⚠️ 职责边界:/avd/storyboard 不管场景和角色
/avd/storyboard 管:全案板、分镜图、全能版(都是"怎么拍")
/avd/scene 管:场景图、场景九宫格、场景锚点(都是"在哪拍")
/avd/character 管:角色卡、三视图、面部多角度(都是"谁在拍")
用户在本命令下说"场景""场景板""场景图""出个场景" → 不处理,提示用 /avd/scene。
Mood 命令(全局识别)
以下命令在任何上下文都生效,调用 engines/mood-slider.md:
| 命令 | 色彩 | 运镜 | 镜头 |
|---|
更燃 | 暖色 | 快切 | 低角度+疾推 |
更虐 | 冷色 | 慢镜 | 高角度俯拍+拉远 |
更甜 | 柔光+粉 | 环绕→狭小空间改前推 | 浅景深 |
更丧 | 去饱和 | 固定 | 空旷构图+空镜 |
更暧昧 | 暖暗 | 拉焦 | 负空间+过肩 |
更恐怖 | 暗调 | 手持 | 窥视视角+极速推进 |
更史诗 | 金色逆光 | 慢推 | 广角+航拍 |
更贵 | 材质感+秩序感 | — | 摄影参数/色卡 |
克制悲壮 | 冷色低调 | 慢镜+固定 | 禁打斗动作词 |
全案板 = 一张合成图,不是分镜拆图
全案板 = 一张 16:9 图,LS 版式由 AI 根据故事类型动态选择:
├── 默认 LS1 影视工业全案板(5模块:顶部项目栏/左侧角色锚点/中部主视觉/右侧分镜序列/底部三栏)
├── 科幻/太空/机甲 → LS2 科幻控制台全案板(HUD细线/银蓝冷光/深空黑背景)
├── 神话巨物/神宫/巨龙 → LS3 神话巨物四镜序列(4大画幅电影帧/暗金标题)
└── 复杂调度/群像动作 → LS15 导演作战室全案(机位动线/多角色站位)
禁止:用户要全案板时输出逐帧独立 Prompt(那是 8b 分镜图像,属于一键生成流水线才出的)。禁止输出视频 Prompt(那是 /avd/create 的事)。
全案板 vs 分镜图(不是一回事)
全案板(full_board)= 导演全案板,一张图5模块
├── 顶部项目栏
├── 左侧角色锚点
├── 中部核心主视觉/场景概念图
├── 右侧分镜序列
└── 底部技术参数/色彩脚本/情绪曲线
模板:templates/full-board.md
LS:LS1/LS2/LS3/LS4/LS14/LS15/LS16
分镜图(storyboard)= 纯镜头序列,只有分镜帧+参数
├── 顶部片名信息栏
├── 中部核心场景画面
└── 底部 N 镜分镜序列 + 技术参数
模板:templates/quick-board.md
LS:LS5 竖排技术分镜表 / LS6 横幅长镜头时间轴 / LS7 合并帧视频锚点
全案板生成流程(简化路径)
用户说"全案板"(无故事,已有角色/场景):
1. 读取 templates/full-board.md(必须,不走模板=bug)
2. 读取 rules/format-contract.md §1.3(分镜资产格式合同)
3. 读取 api-config.template.env(画幅/语言/平台)
4. 从已有资产提取变量(角色DNA/场景DNA/镜数/时长)
5. 按 templates/full-board.md 结构 + AI 选择的 LS 版式填充 → 输出全案板 Prompt
6. 分镜图张数 = ceil(总镜数/4),每张标注"第N/M张"
7. 每镜标注 11 项完整参数(镜号/时间/阶段/景别/运镜/焦段/灯光/色彩/转场/动作描述/end_state)
8. 标注高潮帧★、首帧、尾帧
分镜图生成流程(简化路径)
用户说"分镜图"(无故事,已有角色/场景/镜数):
1. 读取 templates/quick-board.md(必须,不走模板=bug)
2. 读取 rules/format-contract.md §1.3(分镜资产格式合同)→ 确认 output_type=storyboard_frame
3. 读取 api-config.template.env(画幅/语言/平台)
4. 从已有资产提取变量(角色DNA/场景DNA/镜数/时长/每镜参数)
5. 按 templates/quick-board.md 对应 LS 版式(LS5/LS6/LS7 择一)填充 → 输出分镜图 Prompt
6. 分镜图张数 = ceil(总镜数/4),每张标注"第N/M张"
7. 每张≤4帧,LS6 用 21:9横幅帧+右侧参数区,LS5 用竖排表格,LS7 用合并帧堆叠
分镜图禁止输出:
- ❌ 用 full-board 模板(全案板5模块结构)——分镜图是纯镜头序列
- ❌ 有角色锚点栏/场景概念图模块(那些是 full-board 的模块)
- ❌ 只出 1 张即使总镜数>4 —— 每张≤4帧,必须拆多张
- ❌ 每帧参数缺失(11项参数必须完整:镜号/时间/阶段/景别/运镜/焦段/灯光/色彩/转场/动作描述/end_state)
全案板禁止输出:
- ❌ 视频 Prompt(那是 /avd/create 的事)
- ❌ 逐帧独立图像 Prompt(那是 一键生成 模块8b 的事)
- ❌ 场景图(那是 /avd/scene 的事)
- ❌ 角色卡(那是 /avd/character 的事)
- ❌ Gate 检测清单(全案板图是施工指令,不需要)
- ❌ 连续性检查表(全案板图上已标注帧序/角色/场景一致性)
- ❌ 技术参数总表(全案板 prompt 内的底部信息区已有)
Visual Director Pipeline(导演总控流水线)
此流水线仅在 /avd/storyboard 一键生成 或用户明确要求"完整故事板"/"出全部"时触发。 普通 /avd/storyboard [故事] 走轻量入口(Step 1-3),/avd/storyboard 全案板 走简化路径。
本 Skill 的完整流水线按 13 步执行。
时长自动判断(AI 多维度决策)
导演读取故事后,由 video-director 引擎多维度分析决策时长和镜数,不按字数硬映射:
输入故事 → video-director 分析:
叙事复杂度 │ 情绪转折密度 │ 动作密度
场景切换频率 │ 对话占比 │ 高潮强度
角色数量 │ 时间跨度 │ 故事类型
→ 综合打分 → 决定 5-10s / 15s / 30s / 60s+ / 拆段
不再使用「X字→Ys」固定映射。200字打斗和200字对话需要的时长完全不同。交给 AI 导演判断。
版式样式路由
生成全案图和分镜图时,必须从 engines/layout-styles.md 选择一个 LS 版式样式。VS 负责视觉风格,LS 负责图面排版。(场景图走 /avd/scene,角色卡走 /avd/character)
⚠️ 模板强制规则(防自由发挥)
生成每个资产 Prompt 前,必须先读取对应模板文件。不读模板直接写 = bug。模板文件是 Prompt 结构的唯一权威源,Skill 不重复描述模板内容。
| 产出资产 | 必须读取的模板 |
|---|
| 角色卡 Prompt | templates/character-sheet.md |
| 全案板 | templates/full-board.md |
| 分镜图 | templates/quick-board.md |
| 漫画分镜 | templates/manga-page.md |
| 情绪板 | templates/mood-board.md |
| 台词脚本 | templates/dialogue-script.md |
| 音效表 | templates/sound-design-sheet.md |
| 格式合同 | rules/format-contract.md(锁定 output_type,§1.1-§1.5) |
执行顺序:每项资产 Prompt 生成前 → 先 Read 对应模板 → 按模板结构填充 → 输出。
禁止:
- ❌ 不读模板凭记忆写 Prompt
- ❌ 分镜图用全案板模板——先读 format-contract §1.3 确认 output_type
- ❌ 全案板拆多张 / 分镜图只出 1 张——遵守模板内帧数规则
| 用户说法 | 自动版式 |
|---|
| 全案图 / 全案板 / 项目总览 | AI 动态选择(默认 LS1,科幻→LS2,神话巨物→LS3) |
| 科幻全案 / 太空 / 机甲 / 神使 | LS2 科幻控制台全案板 |
| 神话巨物 / 巨龙 / 神宫 / 云海废墟 | LS3 神话巨物四镜序列 |
| 九宫格 / 拼贴 / 氛围参考 | LS4 九宫格情绪拼贴全案 |
| 技术分镜表 / 执行表 | LS5 竖排技术分镜表 |
| 分镜图 / 15s 动作 / 一剑开天 | AI 动态选择(默认 LS6 横幅长镜头,执行表→LS5,视频锚点→LS7) |
| 合并帧 / 视频分镜图 / 参考图喂视频 | LS7 合并帧视频锚点 |
| 场景图 / 场景参考图 | LS8 场景全能参考板 |
| 场景九宫格 / 多角度锁场景 | LS9 场景九宫格锁定 |
| 双联宽幅 / 首尾锚点 | LS10 双联宽幅场景锚点 |
| 角色卡 / 视频一致性 | 模式A 6模块全量版 |
| 黑金武侠角色卡 / 玄幻角色圣经 | LS12 黑金武侠角色圣经 |
| 科幻角色卡 / 银甲神使 / 机甲角色 | LS13 科幻神使角色系统卡 |
| 全能版 / 一张图锁全部 / 电影圣经 | AI 动态选择(默认 LS14,世界观重→LS16,复杂调度→LS15) |
| 导演作战室 / 复杂调度 / 群像动作 | LS15 导演作战室全案 |
| 世界观 / 阵营 / 地图 / 系列设定 | LS16 世界观设定全能板 |
| 多版本 / 风格对比 / A/B/C 方案 | LS19 多版本风格对比板 |
| 面部一致 / 真人脸 / 演员感 | LS20 面部一致性九宫格 |
| 表情范围 / 表演板 | LS21 十二表情表演板 |
| 服装层次 / 铠甲拆解 / 机甲拆解 | LS22 服装层次爆炸图 |
| 双人关系 / 师徒 / 宿敌 / 情侣 | LS24 角色关系双人板 |
| 战损 / 黑化 / 成长 / 变身 | LS25 角色状态演变板 |
| 场景蓝图 / 俯视 / 机位动线 | LS27 场景蓝图俯视板 |
| 材质光照 / 天气变化 / 色彩脚本 | LS28/LS29/LS32 |
| 竖屏短剧 / 小红书 / 抖音 | LS34 竖屏短视频分镜板 |
| 动作拆解 / 打斗 / 挥剑连拍 | LS35 动作拆解连拍板 |
| 一镜到底 / 长镜头 / 跟拍 | LS38 一镜到底路线板 |
| 首尾帧 / 视频接力 / 转场验证 | LS40 首尾帧对照板 |
如果用户给了参考图风格但没有说 LS 编号,按参考图结构自动匹配,不要只复述“参考图风格”。
13 步流水线(标准版 · 15s)
01 全案版生成 ──→ 02 全案版检测 ──→ 03 角色版生成 ──→ 04 角色一致性检测
│
05 场景版生成 ──→ 06 场景一致性检测 ──→ 07 分镜版生成 ──→ 08 分镜连续性检测
│
09 图像 Prompt 生成 ──→ 10 图像 Prompt 风险检测 ──→ 11 视频 Prompt 生成
│
12 视频 Prompt 可执行性检测 ──→ 13 最终交付版输出
适用:video-director 决策 15s/4镜 · 全案板图 7 格 · 角色/场景独立生成
Pipeline 执行策略
不再按字数固定路由到变体。时长/镜数/复杂度由 video-director 多维度决策后,自动匹配执行策略:
| video-director 决策 | 执行策略 |
|---|
| 5-10s / 2-3镜 | 快速版:角色DNA+场景DNA 内联嵌入分镜 Prompt,不独立出图。全案板 5 格 |
| 15s / 4镜 | 标准版:完整 13 步流水线。全案板 7 格 |
| 30s / 7-8镜 | 完整叙事版:标准版 + 叙事弧检查 + 闪回连续性。全案板 9 格 |
| 拆段(多场景) | 场景切分 → 每场独立 Pipeline → 跨场景一致性检测 |
| 60s+(用户指定) | 全片总案 → 场景拆分 → 每场子 Pipeline → 跨场检测 |
场景切分(拆段时):按地点切换 / 时间跳跃 / 角色进出 / 情绪转折 自动识别边界。
切分输出:
检测到 [N] 个场景:
1. [场景名] — [地点] → video-director 决策时长/镜数
2. [场景名] — [地点] → video-director 决策时长/镜数
优先制作场景 1。完成后回复"下一场"继续。
长文档 DNA 共享(多场景时):
- 角色 DNA 全片只生成一次,跨场共享
- 每场完成后执行子检测;全部完成后执行跨场检测
- 全案板图:选 7 个全片关键帧
Patch Pipeline(局部重跑分支)
用户临时修改时,不重跑全案。只重跑受影响节点,跑完执行对应 Gate。
核心规则:
- 不重跑 01 全案版生成
- 不重定义角色 DNA(除非用户明确要求"换角色")
- 不重定义场景 DNA(除非用户明确要求"换场景")
- 只重跑受影响节点 + 对应 Gate
- 输出只含变更部分,不重复输出全案板
分支路由:
| 用户意图 | 示例 | 重跑节点 | 执行 Gate | 输出 |
|---|
| 改风格 | "换成王家卫" | 07 → 09 → 11 | Gate 08 → 10 → 12 | 新分镜表 + 新 Prompt |
| 改单镜 | "第3镜更暗" | 07(局部) → 09(N镜) → 11(N镜) | Gate 08 → 10 → 12 | 变更摘要 + 新N镜 Prompt |
| 改天气 | "第5镜雨改雪" | 07(N-1→N→后续联动) → 09/11(受影响镜) | Gate 08 → 10 → 12 | 过渡描述 + 变更摘要 |
| 压缩 | "压缩到平台版" | 11 | Gate 12 | 压缩版 Prompt |
| 只要视频 | "出视频 prompt" | 11 → 12 | Gate 12 | 仅视频 Prompt |
| 只要图像 | "出图" | 09 → 10 | Gate 10 | 仅图像 Prompt |
| 改角色 | "主角换发型" | 03 → 04 → 07 → 09 → 11 | Gate 04 → 08 → 10 → 12 | 新角色卡 + 受影响 Prompt |
| 改场景 | "换成雨夜" | 05 → 06 → 07 → 09 → 11 | Gate 06 → 08 → 10 → 12 | 新场景卡 + 受影响 Prompt |
变更摘要格式(每次修改后输出):
📝 变更:[改了什么]
影响范围:[哪些镜/Prompt 被更新]
@参考图:[是否需要同步更新角色卡/场景图/全案板图]
Gate 职责边界
每个 Gate 只看自己的领域,不越界。不通过 = 修正后继续。
| Gate | 只看 | 不看 |
|---|
| 02 全案检测 | 大方向:故事能在目标时长讲完?主角唯一?冲突明确?场景过多?世界观过载?题材禁忌明显冲突?适合视频生成? | 具体角色外貌、场景灯光细节 |
| 04 角色检测 | 角色本身:年龄/性别/服装/发型/脸部特征/道具/身份 → 文字风险 → 跨镜漂移 | 场景灯光、运镜可行性 |
| 06 场景检测 | 空间本身:场景结构/光源方向/色彩/材质/空间动线/关键物件 → 招牌/海报/屏幕/铭文乱码风险 | 角色表情、镜头节奏 |
| 08 分镜检测 | 叙事与动作:镜数合理?每镜动作单一?情绪递进?有无无法生成的复杂动作?多重反转塞进一个镜头? | 可读文字、平台参数 |
| 10 图像检测 | 单图风险:可读文字/乱码/分格拼贴/多手多脸/风格漂移/角色漂移/画面元素过载 | 视频连续性、字幕 |
| 12 视频检测 | 视频可执行性:时长过载?镜头连续?运动稳定?跳色?字幕?穿帮?平台长度风险? | 单图文字风险、角色卡完整性 |
扫描分工(不再重复):
- Gate 02:题材级扫描 — 霓虹/LED/机甲/史诗金光/品牌名等大类违规
- Gate 10:词级扫描 — inscription/combat/ghost/split composition 等具体危险词
- Gate 12:帧级扫描 — 帧间连续性/跳色/字幕/穿帮
Pipeline 交互节点
每个 Gate 通过后暂停,输出当前结果 + 下一步选项。用户可继续、跳过、或修改。
01 全案版生成 → 02 全案检测 ✅
💬 核心设定已锁定:[片名] · [风格] · [时长]
回复"继续"进入角色版 | "改风格" | "改时长" | "跳过角色直接分镜"
03 角色版生成 → 04 角色检测 ✅
💬 角色卡已生成:@角色卡(C1,可叠加 C2/C3/C4/C5/C6/C7/C8)
回复"继续"进入场景版 | "改角色" | "跳过场景直接分镜" | "出视频 prompt"
05 场景版生成 → 06 场景检测 ✅
💬 场景参考图已生成:@场景参考图(S4,可叠加 S1/S2/S3/S5/S6/S7)
回复"继续"进入分镜 | "改场景" | "出视频 prompt"
07 分镜版生成 → 08 分镜检测 ✅
💬 分镜表已完成:[N]镜 · [时长]
回复"继续"生成 Prompt | "改第N镜" | "压缩" | "只出图" | "只出视频"
09 图像 Prompt → 10 图像检测 ✅
💬 图像 Prompt 已生成,检测通过
回复"继续"生成视频 Prompt | "改图N" | "跳过视频直接交付"
11 视频 Prompt → 12 视频检测 ✅
💬 视频 Prompt 已生成,检测通过
回复"交付"输出完整全案板 | "压缩到平台版" | "改第N镜"
13 最终交付 ✅
交互规则:
- 默认模式(粘贴故事 → 选风格 1/2/3):每 Gate 暂停,等待用户确认。输出当前结果 + 下一步选项
- 用户说"继续"或回车 → 进入下一步
- 用户说"跳过X" → 跳过指定步骤(DNA 仍内联嵌入,不独立生成)
- 用户说"改X" → 进入 Patch Pipeline 对应分支
- 一键生成模式:全自动不暂停,仅在最终输出后显示交互提示。用户说「一步一步来」可随时切回逐步确认模式
一致性保证方案
角色和场景的一致性不能只靠 DNA 文字重复。根据预算和需求,Gate 04/06 自动匹配对应方法。方法定义来自 /avd/character 和 /avd/scene skill,此处只做触发路由,不重复定义方法细节。
角色一致性 8 种方法(Gate 04 自动选择,详见 /avd/character)
出图量/锁定强度/费用/耗时 不在此表中写死——从 rules/character-consistency.md 读取最新值。
| 编号 | 方法 | 适用条件(自动触发) |
|---|
| C1 | 角色设定卡(6 模块) | 角色 ≥3 镜 / 15s+ / 用户要求一致性(默认方法) |
| C2 | 三视图 | 用户说「三视图」/ 服装层叠复杂需多面锁定 |
| C3 | 面部多角度(5 角度) | 近景或特写 ≥2 个 / 双人关系戏 / 需多表情 |
| C4 | 表情范围图(12 表情) | 情绪弧线复杂 / 角色需极限表情 |
| C5 | 服装/武器细节卡 | 服装饰品复杂 / 道具需跨镜精细化锁定 |
| C6 | 14 图参考(Nano Banana) | 用户说「14图」/ 最强一致性需求 |
| C7 | IP-Adapter(ComfyUI) | 用户说「IP-Adapter」/ 本地最强锁定 |
| C8 | 角色 DNA 20 字段 | 5-10s 快速版 / 单图 / 短 Prompt(默认最低锚点) |
方法叠加策略(自动判断,只升不降):
- 5-10s 快速版 → C8(DNA 文字,零成本保底),角色 DNA 内联嵌入分镜 Prompt
- 15s/4镜 标准版 → C1(角色卡,1 张图),@角色卡 作为视频工具参考图锚定
- 30s/7-8镜 或 近景/特写 ≥2 镜 → C1 + C3(角色卡 + 面部多角度,2 张图),@角色卡 + @面部参考
- 多场景 / 跨轮次续写 → C1 + C3 + C4(+3 张图),或用户手动升级到 C6、C7
- 用户显式说方法名/编号 → 按用户指定,覆盖自动判断
Gate 04 输出格式:
【Gate 04 角色一致性检测】方法:C1 / C1+C3 / 按自动触发条件选择
□ 20 字段 DNA 完整 — [✅/⚠️]
□ 三视图服装/体型一致 — [✅/⚠️]
□ 6 格五官/发色/肤色统一 — [✅/⚠️]
□ 无红色标注/箭头/文字 — [✅/⚠️]
□ 材质状态(磨损/霜雪/浸湿/锈斑)跨格一致 — [✅/⚠️]
□ 否定锚定到位("这不是一个XX的角色")— [✅/⚠️]
□ 光线响应描述完整(暗处vs光线下变化)— [✅/⚠️]
□ 表情毫米级量化为物理量(非形容词)— [✅/⚠️]
□ 道具同源性体现(平行构图+对应高光)— [✅/⚠️/N/A]
□ 角色卡已生成 → @角色卡 引用就绪 — [✅/⚠️]
□ 跨镜漂移风险:[有/无] — [如有,标注风险镜号]
[✅ 通过 / ⚠️ 需修正:具体问题]
场景一致性 7 种方法(Gate 06 自动选择,详见 /avd/scene)
出图量/锁定强度/费用/耗时 不在此表中写死——从 rules/scene-consistency.md 读取最新值。
| 编号 | 方法 | 适用条件(自动触发) |
|---|
| S1 | 俯拍图 | 室内/庭院/需锁定空间布局 |
| S2 | 4 宫格 | 中小场景(房间/走廊) |
| S3 | 9 宫格 | 复杂场景 / 用户说「场景九宫格」 |
| S4 | 全能参考模式 | 15s+ / 同空间连续(默认方法) |
| S5 | 720° 全景图 | 30s+ / 多角度视频拍摄 |
| S6 | 环绕视频截图法 | 3D 引擎 / 空间一致性极高需求 |
| S7 | 文字场景锁定 | 5-10s 快速版 / 单场景短片(默认最低锚点) |
方法叠加策略(自动判断,只升不降):
- 5-10s 快速版 → S7(文字场景锁定),场景 DNA 内联嵌入分镜 Prompt
- 15s/4镜 标准版 → S4(全能参考模式,1 张图),@场景参考图 作为视频工具参考图锚定
- 复杂场景(宫殿/战场/多层次空间) → S3(9 宫格)或 S4,9 视角全覆盖
- 30s+ / 多场景 / 系列化 → S4 + S5(全能参考 + 720° 全景),一个场景一张全能图 + 一个全景
- 用户显式说方法名/编号 → 按用户指定,覆盖自动判断
Gate 06 输出格式:
【Gate 06 场景一致性检测】方法:S4 / S3 / 按自动触发条件选择
□ 空间尺度匹配角色([具体检查])— [✅/⚠️]
□ 空间蓝图完整(尺度/形状/材质/结构关系)— [✅/⚠️]
□ 关键物件含尺寸+位置+时间叙事("三千年前地震震倒的")— [✅/⚠️]
□ 主光系统分层完整(顶光/面光/反射漫反射层)— [✅/⚠️]
□ 光路径描述完整(光源→穿过什么→折射→化为漫射光)— [✅/⚠️]
□ 主光与角色肤色不冲突 — [✅/⚠️]
□ 物件状态有时态("尚未睁眼""此刻未点亮")— [✅/⚠️]
□ 场景↔角色视觉桥(道具与人物特征对应关系)— [✅/⚠️/N/A]
□ 招牌/海报/屏幕/铭文乱码风险扫描 — [✅/⚠️]
□ 场景参考图已生成 → @场景参考图 引用就绪 — [✅/⚠️]
□ 色彩+氛围9格统一收束(九宫格模式时)— [✅/⚠️/N/A]
✅ 通过 → 进入 Gate 08 分镜检测
DNA 继承链(不可断裂)
01 全案版 → 角色DNA + 场景DNA + 色彩DNA + 道具DNA(首次定义)
↓
03 角色版 → 继承角色DNA,锁定20字段,按自动匹配或用户指定方法生成角色卡(→ /avd/character)
↓
05 场景版 → 继承场景DNA + 色彩DNA,锁定空间/灯光/氛围,按自动匹配或用户指定方法生成场景参考图(→ /avd/scene)
↓
07 分镜版 → 继承全部DNA,角色DNA必须逐镜重复 + @角色卡/@场景图引用到位
↓
09 图像Prompt → 继承全部DNA,每张图含角色DNA锚定片段 + 场景色彩系统
↓
11 视频Prompt → 继承全部DNA,每镜以角色DNA片段开头 + @全案板图/@角色卡/@场景参考图硬引用
铁律:
- 后续步骤禁止重新定义角色外貌、服装、场景结构、核心色彩、关键道具
- 发现冲突 → 先修正冲突,再继续生成
- 任何一个 DNA 环节断裂,后续所有输出不可信
- 一致性方法一旦确定,后续步骤只升不降。跨步骤升级时在对应 Gate 中标注升级原因
长文档 DNA 共享规则(多场景拆段专用)
长文档切多场时,DNA 跨场共享,防止每场重新生成导致角色漂移:
1. 全局唯一 DNA:
- 角色 DNA(主角、核心反派、核心配角):全片只生成一次,跨所有场共享
- 核心道具 DNA:全片只定义一次,跨场追踪
- 色彩系统:全片统一,每场可微调氛围但基底色温不变
2. 每场独立 DNA:
- 场景 DNA:每场独立生成,不跨场复用(不同场景空间不同)
- 龙套角色 DNA:仅在本场有效,不出现在跨场检测中
3. 换装规则:
- 角色换装(如"制服 → 雨衣")是剧情状态变化,不是角色漂移
- 换装必须标记:
⚠️ 状态变化:[角色名] [场景N] [原服装] → [新服装],原因:[剧情理由]
- 原始角色 DNA 不覆盖,追加状态标记
- 换装后下一场如需恢复原装,再次标记
4. 跨场检测清单(每场完成后执行):
□ 角色外观跨场连续?(含换装标记)
□ 道具跨场追踪?(出现 → 持有 → 消失 有交代)
□ 时间线连续?(无跳跃或跳跃有说明)
□ 情绪曲线跨场不跳变?(渐变而非突变)
□ 色彩系统跨场统一?(仅允许有意变化)
5. 禁止行为:
- ❌ 每场重新生成角色 DNA
- ❌ 换场时未经标记改变角色外貌
- ❌ 跨场时道具凭空出现或消失
- ❌ 每场独立定义色彩系统
用户交互流程
以上 13 步流水线在内部自动执行。用户看到的是 3 步交互:
Step 1: 提取故事信息(内部使用,不对外展示)
从用户输入中自动提取:片名、类型、主角、对手、核心冲突、世界观场景、情绪倾向、Mood 倾向。同时自动判断时长和镜数。
缺字段自动补全:没角色名 → 起电影感名字;没明确类型 → 按冲突强度推断。
重要:Step 1 信息提取表仅内部使用。第一轮推荐不展示完整提取表,完整表放入 /avd/storyboard 一键生成 输出。
Step 2: 智能推荐(轻量入口)
第一轮推荐只输出一句话识别 + 时长判断 + 3 个方向,轻量不重:
我识别到这是一个「[关键词1] + [关键词2] + [关键词3]」的[情绪] [类型] 场景。
建议时长:[15s/4镜],[一句话理由]。
推荐 3 个方向:
1. [风格名] [格式名]:[一句话适用场景]
2. [风格名] [格式名]:[一句话适用场景]
3. [风格名] [格式名]:[一句话适用场景]
回复 1 / 2 / 3,或输入「一键生成」。
说「看全部」可浏览完整风格/格式/工作流。
重要规则:
- 推荐只用风格名+格式名(如「东方玄幻全案板」),不暴露内部编号。风格编号只在用户说"看全部"时展示。
- 一键生成默认使用单一最匹配主风格。只有用户明确说出「融合」「多版本」「推荐1(如果推荐1本身是融合)」或手动指定组合时,才进行风格融合。禁止自动融合。
推荐引擎规则(故事关键词 → 风格/格式):
| 故事关键词 | 推荐风格 | 推荐格式 |
|---|
| 修仙/古风/玄幻 | 东方玄幻 | 全案板 / 角色卡 |
| 武侠/复仇/谍战/格斗 | 黑金动作 | 全案板 / 关键帧 |
| 机甲/驾驶舱/外骨骼/机器人战斗 | 科幻机甲 | 全案板 / 海报 |
| 太空/空间站/仿生人/AI/外星 | 暗黑科幻 | 场景概念卡 / 关键帧 |
| 赛博/未来都市/黑客/虚拟现实 | 赛博佛学 | 场景概念卡 / 海报 |
| 悬疑/密室/犯罪/恐怖 | 悬疑惊悚 | 快速故事板 / 情绪板 |
| 都市/爱情/职场/暧昧 | 都市情绪 | 场景概念卡 / 情绪板 |
| 校园/青春/初恋/成长 | 青春校园 | 四格漫画 / 角色卡 |
| 童话/小动物/桌面宠物/儿童 | 3D动画电影风 | 全案板 / 角色卡 |
| 水彩/手绘/绘本/治愈 | 童话绘本风 | 情绪板 / 场景概念卡 |
| 日系/宫崎骏/日常魔法 | 日系手绘治愈风 | 场景概念卡 / 情绪板 |
风格名规范:
- 默认推荐使用通用风格名:
3D动画电影风 日系手绘治愈风 童话绘本风
- 禁止在默认推荐中直接使用品牌名:
Disney Pixar Studio Ghibli 吉卜力 迪士尼
- 品牌名仅在用户说「看全部」或明确指定品牌风格时展示
- 科幻题材禁止默认推荐机甲。仅当文本明确出现机甲/驾驶舱/外骨骼/机器人战斗单位等硬核机械战斗元素时,才推荐科幻机甲风格。太空/空间站/仿生人/AI/外星等题材默认推荐暗黑科幻
完整 53 种风格 → 说 "看全部" 展示(完整列表见 engines/styles.md)。
题材禁忌矩阵
题材确定后,自动追加禁止词。Gate 02 全案检测扫描禁止词,出现则立即替换。核心原则:不串味、不过度史诗化、不古今穿帮。
| 题材 | 允许词 | 禁用词 | 易串味方向 |
|---|
| 东方玄幻 | 剑/佛/寺/雨/雪/古 | 霓虹灯/LED/街灯/手机/便利店/现代光源 | 赛博/都市 |
| 都市情感 | 便利店/地铁/办公室 | 机甲/驾驶舱/外骨骼/佛像/史诗金光 | 史诗/恐怖 |
| 科幻太空 | 空间站/木星/休眠舱 | 机甲(无驾驶舱词时)/剑/佛/寺/霓虹灯牌 | 玄幻/武侠 |
| 治愈儿童 | 桌面/键盘/牛奶 | Disney/Pixar/吉卜力(品牌名)/血腥暴力 | 恐怖/科幻 |
| 悬疑犯罪 | 密室/倒计时/脚印 | 史诗佛像金光/机甲/霓虹灯牌 | 史诗/治愈 |
| 恐怖民俗 | 冥婚/纸钱/红盖头 | 霓虹灯/LED/机甲/Disney | 治愈/都市 |
| 校园青春 | 教室/课桌/毕业 | 机甲/霓虹灯牌/东方玄幻 | 史诗/恐怖 |
| 职场现实 | 办公室/HR/PPT | 环绕旋转运镜/机甲/东方玄幻 | 史诗 |
| 历史战争 | 城楼/箭矢/鸽子 | 霓虹灯/LED/手机/机甲/Disney/现代光源 | 科幻/赛博 |
| 赛博朋克 | 霓虹(允许)/义体/数据 | 机甲(无驾驶舱词时)/东方玄幻史诗化 | 东方玄幻 |
| 美食生活 | 摊/厨房/料理 | 机甲/史诗/科幻UI | 科幻/恐怖 |
| 搞笑喜剧 | 面试/奶茶/冷笑话 | 机甲/史诗/东方玄幻/悬疑惊悚 | 恐怖 |
扫描时机:题材确定后立即扫描,Prompt 生成后再次扫描。两次扫描任一命中禁止词 → 替换。
Step 3: 用户确认 → 路由 Pipeline → 输出
用户回复 1/2/3 确认风格 → 进入 Pipeline(正常模式:每 Gate 暂停等待确认),video-director 决策时长/镜数/执行策略,每个 Gate 通过后输出当前结果 + 下一步选项。详见 Pipeline 交互节点。
用户说 一键生成 → 跳过 Step 2 推荐,自动选主风格 + 自动判断时长路由,全流程不暂停,直接出完整 11 模块全案板。
用户说 一步一步来 → 在任意模式中强制切回每 Gate 暂停确认模式。
用户说 简洁 → 输出精简(仅模块 4+6+8),Pipeline 不变。
用户说 出视频 prompt / 出图 / 压缩到平台版 → 走 Patch Pipeline 对应分支。
快捷指令
/avd/storyboard — 故事板生成
| 指令 | 效果 |
|---|
/avd/storyboard [故事] | 粘贴故事 → 智能推荐 2-3 个风格方向 |
/avd/storyboard 一键生成 [故事] [时长] [镜数] | 直接出 11 模块完整故事板 |
/avd/storyboard 一键生成 简洁 | 精简输出:角色+场景+分镜表+Prompt |
/avd/storyboard 多版本 | A/B/C 三版本对比 |
/avd/storyboard 一键全平台 | GPT Image + Midjourney + SD 三平台输出 |
/avd/storyboard 看全部 | 展示 53 种风格 + 10 种格式 + 全部工作流 |
参数:时长(如 15s) / 镜数(如 4镜) / 风格名 / 格式名
/avd/character — 角色设计
| 指令 | 效果 |
|---|
/avd/character [角色名] [描述] | 默认 6 模块角色设定卡(出图模式,无文字标注) |
/avd/character 三视图 [角色名] | 正/侧/背三视图 |
/avd/character 面部多角度 [角色名] | 5 角度面部特写 |
/avd/character 角色DNA [角色名] | 20 字段文字锚定(零成本) |
/avd/scene — 场景设计
| 指令 | 效果 |
|---|
/avd/scene [描述] | 默认全能参考图(出图模式,无标注) |
/avd/scene 场景九宫格 [描述] | 3×3 九宫格场景参考图,9 视角空间全覆盖 |
/avd/video — 视频 Prompt
| 指令 | 效果 |
|---|
出视频 prompt | 压缩模式(≤ {PLATFORM}_MAX_PROMPT_CHARS 字),直喂 {VIDEO_PLATFORM_DEFAULT} |
全局调整
| 指令 | 效果 |
|---|
更燃 / 更虐 / 更甜 / 更丧 / 更暧昧 / 更恐怖 / 更史诗 | Mood 滑块一键调整 |
第N镜 [修改内容] | 单镜修改(如 第3镜更暗 第5镜雨改雪) |
切换风格 [风格名] | 风格迁移,保持角色/场景不变 |
输出连续版 / 输出英文版 / 输出平台压缩版 | 衍生版本输出 |
角色一致性 [方法名/编号] | 手动指定角色一致性方法,如 C1 C3 C6 C1+C3 |
场景一致性 [方法名/编号] | 手动指定场景一致性方法,如 S4 S3 S5 S4+S5 |
更多指令
展开查看完整指令集
角色设计(完整):
| 指令 | 效果 |
|---|
/avd/character 导演标注版 [角色名] | 角色卡 + 红色标注/编号(团队协作) |
/avd/character 12表情 [角色名] | 3×4 宫格情绪范围图 |
/avd/character 服装武器细节卡 [角色名] | 服装+武器独立细节卡 |
/avd/character 14图参考 [角色名] | Nano Banana 最强锚定(14 图全角度) |
/avd/character IP-Adapter [角色名] | ComfyUI IP-Adapter 本地锁定 |
场景设计(完整):
| 指令 | 效果 |
|---|
/avd/scene 导演标注版 [描述] | 全能参考图 + 箭头/编号/红框 |
/avd/scene 720全景 [描述] | 360°×180° 全景环境图 |
/avd/scene 环绕截图 [描述] | 环绕视频 → 8 角度截图 |
/avd/scene camera remix [描述] | 同场景多角度镜头变化 |
视频 Prompt(完整):
| 指令 | 效果 |
|---|
详细模式 / 展开 prompt | 完整段落(3000+字),Runway/Sora/可灵 |
生成视频分镜图 / 合并帧 | 多帧合并为 3-4 张画面锚点 |
切分各帧 / 逐帧接力 | 逐帧出图 + 锁帧链 |
生成首尾帧 | 帧1 + 帧N 对比图 |
继续下一段 / 续写下一段 | AI 自动续写剧情 + 跨段衔接 |
用 [平台] 生成视频 | 调 API 直出(Seedance/Runway/可灵/Luma/Pika) |
风格调整:
| 指令 | 效果 |
|---|
/avd/style 换成 [风格名] 但保持角色 | 风格迁移(只改视觉不改剧情) |
/avd/style 多版本 | A/B/C 三版本对比 |
/avd/style 压缩到 MJ / 压缩到 SD | 平台最佳长度压缩 |
/avd/style 看全部 | 浏览 53 种风格 |
海报:
| 指令 | 效果 |
|---|
/avd/poster [故事/描述] | 电影海报/宣传海报 |
Mood 滑块详情:
| 指令 | 色彩 | 运镜 | 镜头 |
|---|
更燃 | 暖色 | 快切 | 低角度+疾推 |
更虐 | 冷色 | 慢镜 | 高角度俯拍+拉远 |
更甜 | 柔光+粉 | 环绕 | 浅景深 |
更丧 | 去饱和 | 固定 | 空旷构图+空镜 |
更暧昧 | 暖暗 | 拉焦 | 负空间+过肩 |
更恐怖 | 暗调 | 手持 | 窥视视角+极速推进 |
更史诗 | 金色逆光 | 慢推 | 广角+航拍 |
更贵 | 材质感+秩序感 | — | 摄影参数/色卡/秩序构图 |
多画幅适配:
| 指令 | 效果 |
|---|
适配小红书 | 9:16 竖版 |
适配抖音 | 9:16 竖版 |
适配朋友圈 | 1:1 方版 |
适配所有平台 | 自动切换全部画幅 |
推荐默认输出(全案板 · 11 模块)
/avd/storyboard 一键生成默认固定输出以下 11 个模块(全案板):
1. 故事核心 — 片名/类型/核心冲突/叙事结构
2. 情绪基调 — 情绪曲线类型 + 主色调+色号 + 色彩天花板(禁色列表)+ 情绪关键词
3. 视觉风格 — 风格编号+名称+关键词+摄影美学准则 + 适用理由
4. 角色 DNA 锚点 — 主角/对手核心外貌特征 + **角色卡 Prompt**(可直接复制生成角色参考图)
5. 场景 DNA 锚点 — 场景空间蓝图(尺寸/材质/光路径/关键物件规格)+ 主光系统 + 氛围
6. 标准分镜表 — N镜完整版(镜号/时间码/景别/画面描述/运镜/焦段/色彩灯光/转场)
7. 视频完整 Prompt — 从分镜表输出 · 画幅 2.39:1 · **每镜必带 @参考图中文标注** · Seedance/Runway/可灵
8a. 全案板图 Prompt — 一张合成图 · 7格自由排版 · 画幅 16:9 · 中文说明+中文 Prompt+MJ参数
8b. 分镜图像 Prompt — **N 张独立分镜图像 Prompt**(每镜可单独复制)· 画幅 16:9 · 分镜参数+对白意图+中文 Prompt+Negative+MJ参数
9. 连续性检查 — 角色/场景/光照/道具跨镜一致性
10. 禁文字 / 禁动作 / 禁风格漂移扫描
11. 技术参数总表 — 画幅/摄影机/焦段覆盖/景深策略/色彩系统+天花板/灯光系统分层/摄影美学/负面词
分镜数量规则:
- 镜数/时长由
video-director 多维度决策(非固定字数映射),用户未指定时参考 api-config.template.env 平台限制
- 用户指定镜数/时长时以用户为准
画幅规则:
- 图像版 → 读取 api-config.template.env
DEFAULT_ASPECT_RATIO(默认 16:9)
- 电影版(Seedance / Runway / Kling)→ 2.39:1(电影宽银幕)
- 两套 Prompt 分别标注画幅,不混用
输出格式
全案板(格式 1)模板 — 一键生成输出
【1. 故事核心】
片名:[2-8字] · 类型:[类型] · 时长:[15s/30s] · 叙事结构:[结构]
核心冲突:[一句话:谁对抗谁,主角要突破什么]
【2. 情绪基调】
情绪曲线:[类型]:[阶段1]→[阶段2]→[阶段3]→[阶段4]
主色调:[3-4个颜色,含中文名+色号]
色彩天花板:[全片暖色上限说明 + 明确禁用色。例:全片暖色不超青铜金 #8a7a5a,不使用正红/正橙/正黄]
情绪关键词:[3-5个中文情绪词]
【3. 视觉风格】
风格:[编号] · [名称]
摄影美学:[一句电影级美学准则——镜头如何"注视"这个故事。例:"镜头考古学式的冷静靠近,无炫技、无子弹时间、无网文转场"]
关键词:[5-8个视觉关键词,中英文均可,用于 Prompt 锚定]
适用理由:[为什么这个风格匹配这个故事]
【4. 角色 DNA 锚点】(以下 DNA 片段必须出现在每个镜头的 Prompt 中)
[角色名]:[身份],[固定外貌特征 1-2 句,含服装/武器/面部标记]
→ Prompt 重复片段:`[中文 DNA 片段,每个镜头 Prompt 必须包含]`
[角色名]:[同上]
→ 角色卡 Prompt(可直接复制生成角色参考图,锁死面部/服装/道具):
6 模块角色设定卡,[角色名]:[性别/约年龄/身份一句话]。
模块1 左列:三视图(正面全身站姿/右侧面/背面)。
正面:[站姿+服装逐层描述:内层→外层→配件。每层含材质+颜色+状态(新旧/磨损/霜雪/浸湿),配件含尺寸(拇指大小/一掌长)+系法(皮绳/细绳/金属扣)+位置(锁骨/腰间/手腕)。禁止只写"穿着XX"而不写材质状态]
右侧面:[层叠关系+侧缝线+材质过渡(如狼毛肩→背渐短)]
背面:[背面层次+发长与外套关系+后摆特征(是否拖地/浸湿/磨损)]
服装必须含否定锚定:如"这不是战斗装束——无护甲/无武器挂点/无金属护具"
模块2 中上:面部多角度(正面/45度/正侧面特写)。
正面:[脸型骨骼+眉型眉尾方向+眼型内角外角+双眼皮宽窄+瞳色(含光线变化:直射时X色,背光时Y色)+鼻梁鼻翼鼻尖+嘴唇厚薄+肤色(含原因:常年不见阳光的素白/长期户外的风霜)+整体面容气质一句话]
45度:[此角度强调的特征:颧骨可见度/下颌线角度/耳廓大小]
正侧面:[鼻梁高度+下颌线角度+耳位置+睫毛长度方向]
五官描写的精度要求:形状+尺寸+方向——不是"眼型细长",而是"眼型略细长,内眼角略尖外眼角微上挑但不飞扬"
模块3 右上:6 种表情([情绪1]/[情绪2]/[情绪3]/[情绪4]/[情绪5]/[情绪6])。
每种表情按以下格式:[表情名]——[面部动作,按毫米级描述]。例:"微笑——半嘴角上扬约2mm,这是这个角色的极限笑容幅度"。瞳孔大小变化、眉移动量、嘴角位移量均需量化。
6种情绪按故事弧排列:平静→初次反应→认出/领悟→承受/悲伤→释然→收束。不是6个孤立表情,是角色的情绪弧线。
全体6格同一面部骨骼结构,仅表情+瞳孔大小变化。禁止外扩到夸张程度。
如有"极限表情",明确写出上限:"此角色最大笑容幅度=嘴角上扬约2mm"。
模块4 左下:手部特写(正面展开/背面握拳/关键特征面)。
手指:[长度/指节突出度/指甲形状与状态/甲床颜色/茧子或痕迹的位置与原因]。否定锚定:"虎口无明显茧子——这不是一个常年握剑的手"。
关键特征:[如有胎记/疤痕/纹身:形状用自然物比喻(如闪电劈入冰面冻结),主线几道支线几条末端状态,在暗处vs光线下的视觉变化]
背面:[手背肤色+血管+无意识手势(思考时食指微翘/紧张时拇指掐食指侧)]
模块5 中下:关键道具。
每个道具:[名称]+[尺寸]+[材质+状态(锈斑/磨损/包浆/霜冻)]+[表面纹理]+[光线响应]
道具如与人物的身体特征同源(如胎记与镜面裂纹同形),用「平行构图+对应高光」强调同源性。描述格式:将两件同源物并排,标注"X的纹理走向/颜色/末端分叉与Y一一对应"。
否定锚定:如有需要澄清的——"裂纹不是破损,是铸造时模具自带的纹路"
模块6 右下:发型动态([状态1]/[状态2]/[状态3])。
静止:[束法+束发位置+束发长度+余发披散范围+碎发位置与长度+发质(粗细/软硬/贴头皮度)+发色]
[动态1]:[如微风——碎发方向+束发尾部运动+主发体是否移动]
[动态2]:[如低头——所有发丝滑落方向+束发移位+碎发遮挡面部的具体部位+形成的遮蔽感/情绪]
发色与模块2瞳色/眉色一致性标注。
白色/浅灰背景,均匀摄影棚光,禁止彩色背景。6 格白线分隔。
角色服装/发色/五官/体型/肤色 6 格完全一致,禁止跨格变化。
禁止在画面中出现:红色标注线、箭头、文字、编号、方框、引线。
所有细节通过光影、对焦、构图对比传达,不叠加任何文字或符号。
道具模块如涉及同源设计,用平行构图+对应高光传达,不加文字说明。
**【Gate 04 角色一致性检测】方法:[C1 / C1+C3 / 按自动触发条件选择]**
□ 20 字段 DNA 完整 — [✅/⚠️]
□ 三视图服装/体型一致 — [✅/⚠️]
□ 6 格五官/发色/肤色统一 — [✅/⚠️]
□ 无红色标注/箭头/文字 — [✅/⚠️]
□ 材质状态(磨损/霜雪/浸湿/锈斑)跨格一致 — [✅/⚠️]
□ 否定锚定到位("虎口无茧——不是握剑的手")— [✅/⚠️]
□ 光线响应描述完整(暗处vs光线下变化)— [✅/⚠️]
□ 表情以毫米级物理量描述(非"微笑"而是"嘴角上扬约2mm")— [✅/⚠️]
□ 道具同源性体现(平行构图+对应高光)— [✅/⚠️/N/A]
□ 角色卡已生成 → @角色卡 引用就绪 — [✅/⚠️]
□ 跨镜漂移风险:[有/无] — [如有,标注风险镜号]
[✅ 通过 / ⚠️ 需修正:具体问题]
【5. 场景 DNA 锚点】
[场景名]
空间蓝图:[尺度/形状/材质/结构关系。例:圆形内殿直径二十丈,殿顶半塌,上方数十丈冰层如天空,殿心黑水潭静止如镜]
关键物件:[每个关键物件含尺寸/位置/视觉特征。例:青铜镜直径三丈,无边框悬于水面三尺之上,镜中倒映的不是现实而是三千年前燃烧的古城]
主光系统:[光源分层:顶光来自何处+面光来自何处+反射/漫反射层。例:顶光仅冰层月光漫射冰蓝柔光,面光来自镜面金色裂纹自下而上,黑水倒映全部光源形成第三层漫反射]
氛围:[空间给人的情感压迫感]
→ Prompt 重复片段:`[中文 DNA 片段,每个镜头 Prompt 必须包含]`
[副场景名]:[同上,如有]
**【Gate 06 场景一致性检测】方法:[全能参考模式(S4)/ 9宫格(S3)/ 按自动触发条件选择]**
□ 空间尺度匹配角色 — [✅/⚠️]
□ 空间蓝图完整(尺度/形状/材质/结构关系)— [✅/⚠️]
□ 关键物件含尺寸+位置+时间叙事 — [✅/⚠️]
□ 主光系统分层完整(顶光/面光/反射漫反射层)— [✅/⚠️]
□ 光路径完整(光源→穿过什么→折射→漫射光)— [✅/⚠️]
□ 物件状态有时态("尚未睁眼""此刻未点亮")— [✅/⚠️]
□ 场景↔角色视觉桥(道具与角色特征对应)— [✅/⚠️/N/A]
□ 招牌/海报/屏幕/铭文乱码风险扫描 — [✅/⚠️]
□ 场景参考图已生成 → @场景参考图 引用就绪 — [✅/⚠️]
□ 色彩+氛围统一收束(九宫格模式时)— [✅/⚠️/N/A]
[✅ 通过 / ⚠️ 需修正:具体问题]
---
### 场景参考图 9 宫格 Prompt(用户说「场景九宫格」时输出)
> 3×3 九宫格布局,同一场景的 9 个视角。白线分隔,禁止跨格光跳色跳氛围断裂。禁止红色标注、箭头、文字、编号。
场景设定 · [场景名] · 9宫格
3×3 九宫格 Prompt(出图模式 · 无标注)
────────────────────────────────────
上排:全貌与结构
────────────────────────────────────
左上:正面全景
[机位:从哪个方向/哪个入口向内拍摄]
前景:[门口元素——门框/冰柱/甬道/入门第一眼]
中景:[中距离——台阶/祭器/通道/过渡空间]
远景:[最深处——核心物件与穹顶关系]
整体:[此格的尺度感——"人站在X位置往里看的尺度"]
中上:核心物件正面
[机位:正对核心物件方向]
[画面下半:地面/水面状态(静止/倒影/材质)]
[画面正中:核心物件+镜面内容(如有倒映/映射,比实物暗一个色阶)]
[光源效果:顶光在物件边缘形成轮廓光]
[暗处/深处:尚未激活的次要元素——"仅是沉睡的弧形""尚未睁眼"]
右上:空间顶部仰拍
[机位:从殿心/地面向上仰拍]
[顶部结构:穹顶/冰层/塌陷——"数十丈厚冰层是此殿唯一的天空"]
[材质层次:每层代表什么,透光度差异形成的色带]
[光路径:光源→穿过什么→经历什么折射→化为怎样的漫射光覆盖全殿]
[塌陷断面:如玻璃碎口+残存雕刻被吞没状态]
────────────────────────────────────
中排:核心元素细节
────────────────────────────────────
左中:墙面/壁面(未激活状态)
[机位:近距离正对墙面]
[表面状态:平滑/粗糙/微弱倒映]
[深处嵌物:未点亮/未激活状态的符文/纹路——笔画比周围略暗如沉积层]
[可辨笔画:曲线/直角/走向+尺寸范围(最大X尺,最小指甲盖大)]
[深度层次:嵌物在不同深度——近表面清晰,深处已模糊如墨迹洇水]
中中:核心物件背面/侧面
[机位:从物件背面/侧面拍摄]
[材质与纹理:铸造/雕刻纹路走向+凸起与凹陷处颜色差异]
[纹理与墙面符文关系:主脉→支脉延伸逻辑+隐含对应]
[悬浮/支撑方式:物件与地面间隙——"无形力量""无物理支撑"]
右中:周边物件群(原地状态)
[机位:近距拍摄物件群]
[物件清单:每件含名称+状态(站/倒/原位)+时间原因("三千年前地震震倒的,口朝向殿门")]
[排列逻辑:保持X千年前的角度/顺序]
[封存状态:被封在透明冰层/无划痕无气泡/如时间胶囊]
[材质在封存下的变化:冰的折射如何改变颜色/纹理]
────────────────────────────────────
下排:地面、光影、深处
────────────────────────────────────
左下:地面材质与痕迹
[机位:极低角度贴地拍摄]
前景:[地面材质+表面加工痕迹(打磨纹路)+冰霜形态(如透明藤蔓蔓延)]
中景:[冰面区域——平滑处如镜面倒映X,粗糙处散落霜晶]
痕迹:[人物走过的路径——足迹深浅(他走得很慢)+足迹边缘已开始重新结霜]
中下:暗处/水下隐藏元素
[机位:正上方垂直俯拍,穿入水面以下]
[水下元素:悬浮位置+排列方式(不是网格,是自然散落)+数量]
[个体差异:"每一张略微不同——曾经是不同的人"]
[水面从下方看的效果:如玻璃天花板]
[外部光射入水下:光斑缓慢移动+短暂照亮轮廓]
右下:场景↔角色视觉桥(关键帧参考)
分屏构图——左半场景X特写、右半角色Y特写
左半:[场景中的纹理/裂纹/特征——走向/宽度/分支/光色/边缘状态]
右半:[角色身体的对应特征——走向/角度/末端与场景一一对应]
共同:[此刻共享的发光色+脉动频率]
"X的纹理走向、分叉角度、末端细丝与Y一一对应"
────────────────────────────────────
所有 9 格光线一致:[底光色+唯一暖色]
色调统一:[色号1+色号2+色号3+唯一暖色号]
氛围统一:[一句话收束——"极致安静、即将苏醒的沉默"]
9 格白线分隔,禁止跨格光跳色跳氛围断裂。
禁止红色标注、箭头、文字、编号、方框、引线、色温数字。
所有信息通过构图位置、光影方向、材质质感传达。
> 场景九宫格为按需输出。用户说「场景九宫格」或「出场景参考图 9 格」时单独输出。一键生成默认不包含此模块(已含场景 DNA 锚点即可)。
【6. 标准分镜表】(N镜完整版 · 全案板核心 · 每镜必须有细节)
| 镜号 | 时间码 | 景别 | 画面描述 | 对白/台词意图 | 运镜 | 焦段 | 色彩/灯光 | 转场 |
|------|--------|------|----------|-------------|------|------|-----------|------|
| 1 | [时间码] | [景别] | [画面描述 2-4句,含角色动作/环境/构图] | [角色在表达什么——1句中文,导演参考用,不在画面中渲染文字] | [运镜方式+速度] | [mm]+[T值] | [色彩偏移+灯位+光比] | [转场方式] |
| 2 | [时间码] | [景别] | [同上,每镜独立不套模板] | [同上] | [同上] | [mm]+[T值] | [同上] | [同上] |
...
| N | [时间码] | [景别] | [同上] | [同上] | [同上] | [mm]+[T值] | [同上] | [同上] |
> **台词意图规则**:对白/台词意图是导演参考——描述角色在镜中想表达什么。AI 模型无法稳定生成可读字幕,画面中用「嘴唇微动/无声低语/表情传递」等视觉化方式执行,字幕在后期剪辑中添加。
> **分镜细节强制**:画面描述 2-4 句,运镜含速度(疾推/慢摇),焦段含 T 值,色彩含具体灯位和光比。GPT Image 高清模式可放松色彩/焦段参数,MJ/SD 必须全写。
> 分镜表是 Prompt 生成的唯一权威来源。7.视频 Prompt 和 8.图像 Prompt 均从分镜表输出。
【7. 视频完整 Prompt】(从分镜表输出 · 镜数/时长由 video-director 决策 · 电影画幅 2.39:1 · Seedance / Runway / 可灵)
**强制规则**:
1. 每个镜头必须带 `@参考:@全案板图 @角色卡 @场景参考图 @分镜图1 @分镜图2 ... @分镜图N` 中文标注行(分镜图引用与 8(b) 模块的分镜图像一一对应)
2. 每个镜头的中文 Prompt 必须以分镜表对应行为唯一来源,**必须包含该镜的全部技术参数**:景别 + 运镜 + 色彩/灯光 + 转场。焦段和 T 值可在技术参数总表中保留(视频模型不直接使用焦段数据)
**镜头 Prompt 格式**(从分镜表行直接翻译):
镜头1|[时间码]|[中文镜头名]
分镜参数:景别=[景别] | 运镜=[运镜方式+速度] | 色彩/灯光=[色彩偏移+灯位+光比] | 转场=[转场方式]
对白意图:[角色在表达什么——导演参考,不在画面中渲染文字]
中文说明:[1句中文画面描述]
@参考:@全案板图 @角色卡 @场景参考图 @分镜图1
中文 Prompt:[角色DNA中文片段] [画面描述] [景别], [运镜], [色彩/灯光描述], [转场]. 2.39:1 cinema scope. [对白意图的视觉化执行——如 嘴唇微动/无声低语/表情传达...] [负面词]
...
镜头N|[时间码]|[中文镜头名]
分镜参数:景别=[景别] | 运镜=[运镜] | 色彩/灯光=[色彩/灯光] | 转场=[转场]
对白意图:[同上]
中文说明:[同上]
@参考:@全案板图 @角色卡 @场景参考图 @分镜图N
中文 Prompt:[同上]
**台词处理关键**:对白意图写中文给导演看,中文 Prompt 中用视觉化方式执行(嘴唇微动/无声低语/表情传达/凝视......),永远不在 Prompt 中要求生成可读文字或字幕。
**视频必配参考图**(上传到视频工具,防角色/场景漂移):
- @全案板图:[模块8 生成的合成图] — 画面锚点,锁死全片视觉方向
- @角色卡:需单独生成(回复"生成角色卡") — 锁死角色面部/服装
- @场景参考图:需单独生成(回复"生成场景参考图") — 锁死空间/光线
- 如未生成角色卡和场景图,至少上传 @全案板图 作为最低锚点
- 上传顺序:全案板图 ≥ 场景图 ≥ 角色卡
【8a. 全案板图 Prompt】
> 一键生成必须输出一张全案板合成图 Prompt + N 张独立分镜图像 Prompt,两者**分开输出**,不合并。
**全案板图** = 一条 Prompt,生成一张合成图,内含 N 个分镜关键帧按重要程度自由排版(N=时长对应格数,见 Pipeline 时长表)。不是 N 张独立图,不是固定网格,是一张完整全案板视觉海报。画幅 16:9。
**排版自由度**:按故事节奏和镜头重要性自由分配画面比重——
- 关键镜头(高潮/转折/真相揭示)占大格,次要镜头(过渡/建置)占小格
- 不强制均分,不强制网格对齐,可以有画面重叠/出血/跨格
- 参考排版:大中小错落、中心大图+环绕小图、上下分割+侧栏时间线
**参数要求**(GPT Image 高清模式可简化参数,Midjourney/SD 必须全参数):
- 画幅/风格/排版/色调/角色DNA 必须写明
- MJ 版必须尾部追加 `--ar 16:9 --style raw --s 250 --v 6.1`
- SD 版必须追加 SD 专属负面词
**全案板图输出格式**:
中文说明:[1-2句画面描述,说明排版逻辑和核心画面]
排版:[哪个镜号占主位、哪个镜号放侧栏]
中文 Prompt:[中文全案板描述,含排版+每格画面关键词+角色DNA+场景DNA+色调+风格] no text, no labels, no panel numbers, no captions, no watermark, no logo, no messy panels, no broken grid lines, no readable text, no calligraphy, no split composition artifacts, no diptych ghosting, all panels must be the same art style and color palette
MJ 参数:--ar 16:9 --style raw --s 250 --v 6.1
---
【8b. 分镜图像 Prompt】
> 每个镜头输出一条独立图像 Prompt,用户可逐张复制到图像工具。每张图独立统一格式。
> 画幅 16:9。每张图含分镜参数+对白意图,直接从分镜表翻译。
**分镜图像输出格式**:
图1|[中文标题]
分镜参数:景别=[景别] | 运镜=[运镜] | 色彩/灯光=[色彩/灯光] | 转场=[转场]
对白意图:[角色在表达什么——导演参考,不在画面中渲染文字]
用途:关键帧 / GPT Image / MJ / SD
中文 Prompt:[中文图像提示词,含角色DNA+场景DNA,从分镜表画面描述翻译]
Negative:[负面词]
MJ 参数:--ar 16:9 --style raw --s 250 --v 6.1
图2|[中文标题]
分镜参数:景别=[景别] | 运镜=[运镜] | 色彩/灯光=[色彩/灯光] | 转场=[转场]
对白意图:[同上]
...
图N|[中文标题]
...
**分镜图像 Prompt 强制规则**:
- 每图必须独立完整,含角色DNA+场景DNA,不可跨图依赖
- 模块 8 默认使用 `DEFAULT_LANGUAGE`(api-config.template.env)Prompt;用户说「英文版」时切换为英文 Prompt
- 每图中文标题 + 分镜参数 + 对白意图 + 中文 Prompt + Negative + MJ参数七段齐全
- GPT Image 高清模式可省略 MJ参数 行;MJ/SD 版必须加参数行
- 全案板合成图格数不等于镜数时(如 60s+ 选 7 个关键帧),分镜图像 Prompt 仍输出全部镜号
- 用户说「只出图N」→ 走 Patch Pipeline:只要图像分支,输出单张
【9. 连续性检查 + Gate 08 分镜检测结果】
> Gate 08 在分镜表生成后逐镜扫描,以下是检测结果:
**角色连续性**:
□ 服装跨镜一致(含材质状态:磨损/霜雪/浸湿/锈斑不跳变)— [✅/⚠️ 镜X→镜Y变化]
□ 面部骨骼/五官形状跨镜一致 — [✅/⚠️]
□ 瞳色光线响应一致(直射时X色,背光时Y色——跨镜统一)— [✅/⚠️]
□ 道具跨镜一致(出场→持有→消失完整追踪)— [✅/⚠️]
□ 道具与人物的同源特征跨镜保持对应 — [✅/⚠️/N/A]
□ 如有对手/配角:同上检查 — [✅/⚠️/N/A]
**场景连续性**:
□ 同一场景空间跨镜连贯 — [✅/⚠️]
□ 天空/地面/穹顶/背景元素不跳变 — [✅/⚠️]
□ 光路径跨镜一致(光源→穿过什么→折射→漫射逻辑不变)— [✅/⚠️]
□ 物件的时间状态跨镜逻辑正确("尚未睁眼"→不可跨镜突然睁眼)— [✅/⚠️]
**道具连续性**:
□ [道具1]:[出场镜号] → [持有镜号] → [消失/归还镜号] — [✅ 完整追踪 / ⚠️ 断裂]
□ [道具2]:同上 — [✅/⚠️/N/A]
□ 道具形制/纹路/比例/颜色/材质状态跨镜不变 — [✅/⚠️]
□ 道具表面光线响应跨镜一致(锈斑/包浆/霜冻的反射逻辑)— [✅/⚠️]
**运镜可执行性**:
□ 无违规环绕/旋转/穿墙运镜 — [✅/⚠️ 镜X]
□ 狭小空间运镜合规 — [✅/⚠️/N/A]
□ 运镜符合摄影美学准则(不炫技/不网文转场)— [✅/⚠️]
□ 30s版:闪回连续性专项 — [✅/⚠️/N/A]
**情绪/节奏**:
□ 景别递进合理 — [✅/⚠️]
□ 情绪曲线有起伏但不跳变 — [✅/⚠️]
□ 每镜动作单一可执行,无塞入多重反转 — [✅/⚠️]
[✅ Gate 08 通过 / ⚠️ 需修正:具体断裂点及修复建议]
【10. 禁文字 / 禁动作 / 禁风格漂移扫描】
□ 禁文字:Prompt 中无 inscription/name/text/avd/character/written → 全部改为 abstract grooves/scar-like marks/non-symbolic
□ 禁动作:Prompt 中无 combat/fight/attack/battle → 改为 restrained gesture/ritual movement/slow ceremonial
□ 禁风格漂移:所有 Prompt 包含风格关键词 [风格关键词]
□ 高频文字泄漏点:[逐项扫描工牌/店招/监控/海报/硬币/书本]
【11. 技术参数总表】(全案板强制模块,不混入可复制 Prompt)
画幅:[图像版 16:9 / 视频版 2.39:1]
摄影机参考:[型号 + 美学特征]
焦段覆盖:[18mm→135mm 逐镜标注]
景深策略:[逐镜T值变化 · 浅景深与深焦段落交替策略]
色彩系统:[基底色温+主色调色号]
色彩天花板:[全片暖色硬上限色号 + 明确禁用色列表。如:全片不使用正红/正橙/正黄,暖色不超青铜金 #8a7a5a]
灯光系统分层:[顶光来源+面光来源+反射漫反射层 · 无人工光源/无霓虹/无现代灯源]
摄影美学准则:[一句总结镜头态度,如"考古学式冷静靠近""克制凝视为核心,拒绝炫技运镜"]
负面词:[统一追加到所有 Prompt · 含题材专属负面词]
视频 Prompt 输出规范(强制)
- 视频 Prompt 默认使用
DEFAULT_LANGUAGE(api-config.template.env)。用户说「英文版」时输出英文 Prompt。
- 每个 Shot 必须带中文镜头标题
- 每个 Shot 必须带
分镜参数 行——从分镜表对应行提取景别/运镜/色彩灯光/转场,作为分镜表到 Prompt 的翻译桥
- 格式统一为:
镜头1|时间码|中文镜头名
分镜参数:景别=[景别] | 运镜=[运镜方式+速度] | 色彩/灯光=[色彩偏移+灯位+光比] | 转场=[转场方式]
对白意图:[角色在表达什么——导演参考,字幕后期添加]
中文说明:...
@参考:@全案板图 @角色卡 @场景参考图 @分镜图1
中文 Prompt:...(对白意图用视觉化方式执行:嘴唇微动 / 无声低语 / 表情传达...)
镜头2|时间码|中文镜头名
分镜参数:景别=[景别] | 运镜=[运镜] | 色彩/灯光=[色彩/灯光] | 转场=[转场]
对白意图:...
中文说明:...
@参考:@全案板图 @角色卡 @场景参考图 @分镜图2
中文 Prompt:...
- 视频完整可复制连续版(≤ {PLATFORM}_MAX_PROMPT_CHARS 字)和平台压缩版(≤ 800字,视频平台通用安全线)为衍生版本,默认不输出。用户可通过「输出连续版」/「输出平台压缩版」指令单独获取。
- 视频版分镜表中不出现"台词/subtitle/字幕/文字内容"——模型无法稳定生成可读文字,所有台词改为视觉化描述
图像 Prompt 输出规范(强制)
- 图像关键帧统一使用中文标题,必须带分镜参数行+对白意图行:
图1|中文标题
分镜参数:景别=[景别] | 运镜=[运镜] | 色彩/灯光=[色彩/灯光] | 转场=[转场]
对白意图:[角色在表达什么——导演参考,不在画面中渲染文字]
用途:关键帧 / GPT Image / MJ / SD
中文画面:...
中文 Prompt:```...```
Negative:```...```
MJ 参数:--ar 16:9 --style raw --s 250 --v 6.1
- 图像 Prompt 默认使用
DEFAULT_LANGUAGE(从 api-config.template.env 读取,默认 zh);用户说「英文版」时输出英文 Prompt。英文平台(MJ/SD/Flux)自动翻译。GPT Image 高清模式可省略 MJ参数行,其余模式必须加
- 每张图独立输出,方便用户单张复制使用
视频 Prompt 简化规则
- 视频 Prompt(模块 7)必须精简:每个镜头 ≤3 句画面描述 + 运镜 + 转场,总字数 ≤ {PLATFORM}_MAX_PROMPT_CHARS(从 api-config.template.env 读取目标平台限制)
- 平台压缩版(按需输出)≤ 800字(视频平台通用安全线,短于各平台硬上限),去掉场景重复描述,仅保留角色DNA+画面+运镜+转场
- 图像 Prompt(模块 8)可以更详细:每个镜头 3-5 句完整描述
- 技术参数(焦段/T值/色温)保留在分镜表中,不进入复制 Prompt
- 复制 Prompt 只保留:角色 DNA + 场景 DNA + 画面描述 + 运镜 + 色彩/灯光 + 负面词
快速故事板(格式 2)模板
[故事标题] · [风格名称]
图1|[中文标题]
用途:关键帧
中文 Prompt:```...```
图2|[中文标题]
用途:关键帧
中文 Prompt:```...```
...
图N|[中文标题]
用途:关键帧
中文 Prompt:```...```
画幅:[16:9] | 平台:[GPT Image / MJ / SD]
情绪/Mood 调整
用户说以下关键词时自动调整:
更燃 → 暖色+快切+低角度+疾推
更虐 → 冷色+慢镜+高角度俯拍+拉远
更甜 → 柔光+粉色调+浅景深+过肩镜头(狭小室内禁用环绕镜头,改用缓慢前推+拉焦)
更丧 → 去饱和+固定机位+空旷构图+空镜
更暧昧 → 暖暗调+负空间+拉焦+过肩镜头
更恐怖 → 暗调+手持+窥视视角+极速推进
更史诗 → 广角+航拍+慢推+金色逆光
克制悲壮 / 不要热血 → 冷色低调+慢镜+固定机位为主+禁打斗动作词+追加禁动作负面词
注意:情绪调整与运镜可执行性冲突时,运镜可执行性优先。"更甜"在狭小空间(便利店/车内/公寓)→ 禁用环绕镜头,改用缓慢前推+拉焦替代。
闪回/时空切换规则
视频版(必须简化):AI 视频工具难以执行复杂闪回。闪回镜头必须压缩为:
- 单一画面闪现(如"钟面中闪现代村民按钟的残影,暖光一闪即灭")
- 禁止:多人物排队/逐一动作/色彩渐变过渡/多阶段时空切换
- 闪回时长 ≤ 2s,仅 1 个镜头
图像版(可以详细):关键帧图像可以用完整闪回镜头,包含多人场景和色调变化。
单镜修改规则
用户修改单个镜头时(如"第N镜更X"),必须遵守以下规则,确保修改不破坏连续性。
天气修改
天气变更自动补过渡桥:
- 第N镜天气变更 → 在第 N-1 镜末尾插入过渡画面
- 例:
第5镜雨改雪 → 镜4末插入「雨夹雪」过渡镜,镜5起天气改为雪,镜6-7联动(雪景持续),时间码逻辑不变
- 过渡镜头格式:
[原天气]渐转为[新天气],过渡自然,如"雨势渐弱转为细雪飘落,路面从积水反光变为薄雪覆盖"
- 天气修改后必须输出连续性提示:
⚠️ 天气变更:镜4末插入过渡 → 镜5-7联动为雪景
明度/情绪修改
第N镜更暗/更亮 → 仅修改目标镜的光比和曝光,其他镜不变
第N镜更XX(情绪词)→ 仅调整目标镜的情绪色彩,不改变景别和运镜
- 时间码不漂移
连续多次修改
- 依次执行多个修改命令时,所有修改累积生效
- 例:
第2镜更暗 → 第5镜雨改雪 → 第7镜更史诗 → 三个修改全部应用,时间码全序列不漂移,修改间不互相冲突
- 每次修改后输出变更摘要,标注修改范围
角色外观变更
第N镜角色换装/换发型 → 仅当用户明确指令时执行
- 第 N-1 镜末插入换装过渡(如"角色转身进入暗处,再出现时已换装")
- 角色 DNA 其他字段不变(五官/体型/身高/肤色)
负面清单
所有图像 prompt 自动附加:
no watermark, no logo, no random large text, no garbled Chinese,
no broken faces, no duplicated limbs, no messy panels,
no low-quality collage, no text overlay, no cartoon style (unless specified),
no flat illustration, no marketing poster style,
no readable text, no calligraphy, no inscriptions, no lettering of any kind
所有视频 prompt 额外附加:
no flickering, no frame flashing, no sudden brightness jumps, no color shifts,
no morphing, no body distortion, no face melting, no limb warping,
no floating, no sliding feet, no broken physics,
no background shifting, no environment pop-in, no sky color change,
no disappearing props, no weapon shape change, no costume color drift,
no broken continuity between frames, no jump cuts, no ghosting artifacts,
no combat, no attack motion, no explosive action, no fiery battle,
no triumphant posing, no warm victory lighting (when restraint/tragedy is specified)
Prompt 生成规则
角色 DNA 重复规则(视频连续性核心)
每个镜头的 Prompt 必须包含角色 DNA 锚定片段。视频模型跨镜头容易漂移,唯一解是每个 Prompt 都重复相同的角色外貌描述:
固定 DNA 片段格式(中文):
[角色名]:[性别/年龄/身份一句话],[发型+状态],[服装颜色+材质+状态],[手持道具+材质+状态],[面部特征]
示例(沈照):
沈照:年轻女捕快,二十五岁,黑发以素银簪束起,深靛蓝武服外罩雨布斗篷,腰间佩窄直刀,眉心一道旧细疤。
每个镜头 Prompt 都必须以角色 DNA 中文片段开头,确保视频工具逐帧生成时角色不漂移。
禁文字规则(最高优先级)
所有出图/视频 prompt 中,绝对禁止出现需要模型生成的可读文字。画面中如需出现屏幕、标识、书本等内容,改用纯视觉描述:
| ❌ 不可用 | ✅ 替代 |
|---|
| 屏幕显示「提交成功」 | 屏幕弹出一个绿色勾选图标,柔和提示光在屏幕上跳动 |
| 「Error」「404」 | 红色闪烁提示光、警告状态指示 |
| 任何可读中文/英文/数字 | 色块/图标/光影条纹/模糊字符纹理 |
铭文/刻痕/名字专项规则(防止模型生成乱字,权重最高):
| ❌ 危险词(立刻替换) | ✅ 安全替代 |
|---|
| inscription / inscribed marks / carved text / written name | abstract scar-like glowing grooves, non-symbolic, non-calligraphic |
| name / names / characters engraved on the surface | weathered abstract surface markings, unintelligible ancient texture |
| bell shows a name / surface reads a name | faint luminous grooves pulse on the bronze, shapeless and unreadable |
| readable mark / legible symbol | eroded groove catching the light, formless and ambiguous |
核心原则:描述钟面/石碑/书页/屏幕上的标记时,只能用"沟槽""纹理""光影条纹""色块",永远不暗示"可读"。
高频文字泄漏点专项规则(防止模型在常见物品上自动生成乱码文字):
| 场景物品 | ❌ 危险写法 | ✅ 安全替代 |
|---|
| 工牌/名牌/胸针 | name tag pin-on name badge ID card | small blank metal badge, no readable text 无字金属工牌 |
| 店铺招牌 | store sign neon sign with name 店招 | storefront sign cropped, blurred, or only shown as abstract glowing panels, no readable letters 店招只作为模糊发光色块出现 |
| 监控屏幕/CCTV | security monitor CCTV footage | grainy monochrome image, no timestamp, no REC mark, no CCTV UI text, pure video signal |
| 寻人启事/海报 | missing poster with name 寻人启事上的文字 | weathered poster with a blurred photograph, abstract wear patterns where text would be 褪色海报,照片模糊,文字区域已磨损为抽象纹理 |
| 硬币/纸币 | coin with date old coin with text | old tarnished coin, any surface marks are worn smooth and unintelligible |
| 书本/报纸 | newspaper headline book page with text | pages shown only as abstract blocks of grey tone, no readable content |
字幕/台词禁令:所有 Prompt 中禁止出现以下描述:
subtitle can say her line / a subtitle shows / text overlay → 全部替换为 lips barely moving, silent murmur, no visible text
- 模型无法稳定生成可读字幕,字幕必须在后期剪辑中添加
强制扫描:生成 Prompt 后必须逐句扫描,发现以下模式立即替换:
- 引号内的中文
「...」 → 检查是否为屏幕/书本/标识文字,是则替换为视觉描述
- 引号内的英文
"... " → 同上
- 数字序列(如
404 200 500)→ 替换为颜色+光影状态
- 屏幕内容描述含
display written showing reading reads + 具体内容 → 替换为图标/光影/色块
- 铭文/刻痕/名字描述含
inscription name carved text written readable legible symbol character → 替换为 abstract grooves scar-like marks non-symbolic surface texture
- 扫描不通过不输出。此项权重最高,出现一次扣 2 分。
禁动作规则(防止情绪跑偏)
用户指定"克制悲壮""不要热血战斗"等情绪约束时,必须扫描 Prompt 防止以下动作词:
| ❌ 禁止(会被模型理解为打斗) | ✅ 替代(仪式化/克制表达) |
|---|
| combat / fight / battle / attack / strike / slash | restrained gesture / ceremonial movement / slow deliberate motion |
| draws sword to strike / swings blade at | slowly unsheathes the blade, the blade is lowered, no attack motion |
| charges / lunges / aggressive stance | steady advance / composed posture / measured step |
| explosive / fierce / intense battle | controlled / solemn / quiet resolve |
动作约束标准写法(追加到 Prompt 尾部):
no combat, no attack motion, no explosive action, no fiery battle,
no triumphant posing, no warm victory lighting.
The blade is lowered — a restrained ritual gesture, not a fighting stance.
禁鬼片/禁灵异规则(防止情绪片被拍成恐怖片)
用户指定"不要恐怖/不要鬼片/不要跳吓/不要夸张灵异特效"时,必须扫描以下视觉词:
| ❌ 危险(会被模型理解成鬼片) | ✅ 替代(情绪化/克制表达) |
|---|
translucent ethereal ghostly figure spectral phantom | visible only as a soft reflection in glass, slightly faded by condensation and rain, natural human posture |
floating figure hovering disembodied | standing naturally, feet on the ground, reflected in the glass like any living person |
creepy eerie haunting chilling | quiet lonely gentle melancholy |
sudden appearance jump scare flickering apparition | slowly revealed in reflection, always there when you look closely |
镜像/反射角色标准写法(追加到 Prompt 尾部):
The figure in the reflection appears as a natural person seen through condensation-fogged glass,
slightly faded by rain streaks, no ghost effect, no translucency, no floating,
no supernatural distortion — just a soft reflection, like looking through a wet window.
禁止 Split Composition / 拼贴分割
图像 Prompt 中禁止使用 split composition / left half / right half / split screen / diptych:
- 单张图必须是完整统一画面,不能是拼贴/分格/对比图
- 如需表达"同时发生"或"先后变化",用画面内自然元素(如玻璃反射、水面倒影、光影过渡)来表达
- 例:❌
left shows dark store, right shows dawn counter → ✅ foreground shows the cold milk and old coin on the counter at dawn; in the glass reflection behind them, a faint overlapping memory lingers
运镜可执行性规则
现实都市题材(便利店/办公室/车内/公寓等狭小空间)的运镜必须保持物理可执行性:
- ✅ 可用:固定机位、缓慢前推/后拉、水平横移、低角度仰拍、过肩镜头、浅景深变焦
- ❌ 禁止:环绕慢旋、中轴线旋转穿越、航拍级上升、穿越物体/墙面的运镜
- 狭小空间定义:单间面积小于20平米的室内场景(便利店、车内、卧室、电梯、走廊)
Prompt 简化规则
- 视频 Prompt(模块 7):每个镜头 ≤3 句,总 Prompt ≤ {PLATFORM}_MAX_PROMPT_CHARS 字(从 api-config.template.env 读取),去掉焦段/T值等人类导演参数
- 图像 Prompt(模块 8):每个镜头 3-5 句完整描述
- 复制 Prompt 只保留:角色 DNA 片段 + 场景 DNA 片段 + 画面描述 + 运镜 + 色彩/灯光 + 负面词
- 技术参数表(焦段/T值/色温/摄影机)保留为导演参考,不混入可复制 Prompt 中
衍生版 Prompt 规则(按需输出)
一键生成默认只输出逐镜独立视频 Prompt(模块7)和逐镜独立图像 Prompt(模块8)。以下衍生版本通过用户指令触发:
- 视频完整可复制连续版(≤ {PLATFORM}_MAX_PROMPT_CHARS 字,中文,长度=当前平台上限):用户输入
输出连续版 时触发。所有镜头合并为一条连续中文 prompt。
- 视频完整可复制英文版(≤ {PLATFORM}_MAX_PROMPT_CHARS 字,英文):用户输入
输出英文版 时触发。所有镜头合并为一条连续英文 prompt,含角色DNA+场景DNA+运镜+转场+色彩。
- 平台压缩版(≤ 800字,视频平台通用安全线,短于各平台硬上限):用户输入
输出平台压缩版 时触发。去掉场景重复描述、焦段信息、色彩渐变细节,只保留角色DNA片段 + 每镜关键画面描述 + 运镜 + 转场 + 核心负面词。标注 【平台压缩版 · 直接复制到 Seedance / Runway / 可灵】。如镜数≥6且平台上限紧张,建议标注"稳定性提示:可压缩为5镜"。
输出后交互提示
一键生成输出完成后,必须在结尾追加以下交互建议:
💡 可继续输入:
1. 修改第N镜 → 如"第3镜更暗一点""第5镜雨改雪"
2. 输出连续版 / 输出英文版 / 输出平台压缩版
3. 角色一致性 → 角色卡(C1) / 三视图(C2) / 面部多角度(C3) / 12表情(C4) / 14图(C6) / IP-Adapter(C7) / DNA文字(C8)
4. 场景一致性 → 全能参考(S4) / 9宫格(S3) / 俯拍图(S1) / 720全景(S5) / 环绕截图(S6) / 文字锁定(S7)
5. 场景九宫格 → 3×3 九宫格场景参考图,9 视角空间全覆盖
6. 切换风格 → 如"换成黑金动作风"
7. 调整情绪 → 更燃 / 更虐 / 更甜 / 更丧 / 更暧昧 / 更恐怖 / 更史诗
8. 更多指令 → 查询 /avd/character、/avd/scene、/avd/video、/avd/style、/avd/poster 子指令(如"查询 /avd/character")