| name | storyboard-to-seedance-prompt |
| description | 将文字分镜逐条强化为 Seedance 2.0 视频提示词。已完成文字分镜且需要落地为可执行视频提示词时调用。 |
文字分镜到 Seedance2.0 提示词
目标
- 把每个 clip 的文字分镜,转化为更具体、更可执行的 Seedance 2.0 视频提示词,并将产物写到文字分镜文件的同目录。
输入输出
- 输入:
文字分镜.txt(含本集所有 clip)或者一句话要求
- 输出:与输入文件同目录的
视频_ClipXXX.prompt.txt(每个 clip 一个)和对应视频 Clip。
Workflow
- 查看用户指定的
文字分镜.txt,按 clip 划分并逐条读取分镜内容,不得跳段或合并。
- 为每个 clip 在该
文字分镜.txt 的同目录新建/更新 视频_ClipXXX.prompt.txt,按 Seedance 2.0 推荐结构撰写:
- 主体定义行:
将图片N中的[核心特征]定义为[角色名]
- 风格声明行:一句话锁定画风
- 场景与动作段:用自然语言按事件顺序描述,使用「紧接着/随后/顺势」过渡
- 台词与音频段:将文字分镜中的角色对白转写为 Seedance
{} 格式(见下方"台词转写规则")
- 尾部约束行:范围边界 + 反字幕水印
- 对照"硬性标准/自检清单"逐条补全缺失信息。
- 确认每个
视频_ClipXXX.prompt.txt 的最后一行包含"保持无字幕,避免画面生成字幕,不要水印,不要logo,不要BGM"。
- 生成视频:统一使用
changdu CLI(默认走火山方舟 Seedance 2.0)。角色面部特写放在 --image 第一位(最高优先级),全身照放第二位。示例:changdu multimodal2video --image 角色_face.jpg --image 角色_fullbody.jpg --image 场景.jpg --prompt "${HEAD}$(cat 视频_Clip001.prompt.txt)" --ratio 16:9 --duration 15 --wait --output 视频_Clip001.mp4。
使用方法
- 针对文字分镜的每个 clip,按 Seedance 2.0 推荐结构撰写提示词。
- 提示词文本只写画面与执行细节,不写比例、模型、参考图清单等生成参数。
- 禁止使用
-- 符号,Seedance 不解析该符号之后的内容。
参考图分工原则(Seedance 2.0 核心规则)
每张参考图只承担一种职责,禁止混用:
| 图片职责 | 用途 | 示例 |
|---|
| 面部特写 | 锁定角色五官ID | 角色_face.jpg |
| 全身妆造 | 锁定服装/体态 | 角色_fullbody.jpg |
| 场景空间 | 锁定环境/空间布局 | 场景.jpg |
| 道具参考 | 锁定道具外观 | 道具/<道具名>.jpg |
| 站位草稿 | 表达人物空间关系 | 站位草稿.jpg(可选) |
禁止将人物图、场景图、站位草稿、道具图混在同一张图片中,否则会导致站位漂移、人物错位或道具串台。
执行指令段
- 用 3–6 句覆盖全片段内容,每句包含"镜头类型+主体@图片N+动作+空间/光线细节"。
- 使用「紧接着/随后/顺势」等过渡词让模型自然安排节奏。
- 每次角色出镜都用
角色名@图片N 标注对应参考图编号,绝不能只写角色名而省略 @图片N(FAQ:分镜中应该写成「男生A@图片1」而非「男生A」)。
- 角色说话时,将台词用
{} 包裹,融入动作描述中(见下方台词转写规则)。
- 多角色同画面时,在 prompt 末尾追加:
视频全程不要在同一画面中复制相同人物,不要多人同脸。
- 结尾固定追加:本段仅展示上述动作,不展示后续剧情。保持无字幕,避免画面生成字幕,不要水印,不要logo,不要BGM。
台词转写规则(Seedance 2.0 特殊字符规范)
Seedance 2.0 使用以下符号区分不同音频类型:
- 台词:
{台词内容} — 角色说出的对白
- 音效:
<音效描述> — 环境或动作音效
- 音乐:
(音乐描述) — 背景音乐
转写流程
- 识别:文字分镜中所有带引号的台词(
"..."、'...'、:「...」)都必须转写
- 格式:
角色名@图片N + 动作描述 + 说/说道/低声说 + {台词原文}
- 音色锚定:如果该角色有音色参考音频,在台词前加
采用音频N的[音色特征描述]的音色。音色特征应包含具体描述词(如"低厚温润中年男声""清冽有力少女音""沙哑低沉老年女声"),避免只写"采用音频N的音色"而不加特征描述——加上特征描述能显著提升音色参考的准确性(参考 FAQ A-3)
转写示例
文字分镜原文:
苏棠俯身看着病床上的陆衍,眼中满是歉意,低声说:"对不起……陆衍,对不起"
转写为 Seedance prompt:
苏棠@图片1俯身看着病床上的陆衍,眼中满是歉意,采用音频1的低沉坚韧青年女声的音色低声说{对不起……陆衍,对不起}
文字分镜原文:
电话里传来婆婆严厉的声音:"明天早上九点,生殖中心……不许迟到!"
转写为 Seedance prompt:
<电话里传来严厉的女声>{明天早上九点,生殖中心……不许迟到!}
重要约束
- 禁止省略或概括台词内容,必须保留原文
- 每个 clip 中的所有台词都必须转写,不得遗漏
- 15 秒内台词不宜过多(建议不超过 3 句),如分镜台词过多应拆分 clip
- 非面对面的声音(电话、广播、画外音)用
<> 包裹声源描述,紧跟 {} 包裹台词
硬性标准
- 不得合并或省略分镜项;必须覆盖原分镜的全部场景与动作。
- 最低信息线:每个 clip ≥10 个具体名词、≥5 个动词、≥3 个镜头术语。
- 禁止使用"漂亮、好看、震撼"等模糊词,改用可度量细节与可执行动作。
- 明确比例与模型:16:9 或 9:16;Seedance 2.0。
- 绑定一致性资产:角色/场景/道具参考图路径与出镜顺序、出现次数。
连贯性约束规则(防穿帮 - Seedance 2.0 适配)
以下约束通过自然语言融入提示词正文,不使用 【meta-tag】 格式:
1. 范围边界(Scope Boundary)
- 每个 clip 只描述当前 15 秒窗口内的事件。
- 在 prompt 末尾加:
本段仅展示上述动作,不展示后续剧情。
- 如果上一 clip 结尾角色在做某动作,本 clip 开头用「承接上段XXX」自然衔接。
2. 主体定义(Subject Definition)
- 在 prompt 开头用「将图片N中的[特征]定义为[角色名]」绑定参考图。
- 特征写 2-3 个最显著的静态视觉特征即可(如「金黄毛色、圆头大眼的猴子」),确保唯一可识别性。
- 每次角色出镜都在正文中用
角色名@图片N 标注,绝不能只写角色名而省略图片编号。
- 多图素材指向同一主体时统一绑定:
将图片1中的[...]、图片2中的[...] 定义为[角色名]。
3. 角色/道具/场景一致性
- 角色外貌描述融入主体定义行和正文中,不另设独立 meta 块。
- 道具有参考图时,在 prompt 开头绑定(如「图片4为U盘道具参考」),正文中用
道具名@图片N 引用。无参考图的道具通过动作描述体现(如「右手紧握金箍棒」)。
- 场景有参考视频时(360度场景视频),在 prompt 中说明「参考视频N中的场景空间布局,保持人物站位一致」。场景图片同理用图片编号绑定。
- 同一场景的多个 clip 保持场景描述用词一致。
4. 妆造变化处理
- 当角色在当前 clip 的妆造与默认妆造不同时,必须在主体定义行明确标注当前妆造:
将图片1中的[核心特征]定义为[角色名]([妆造名]造型)
- 确保传入的
--image 使用对应妆造的面部特写和全身像,而非默认妆造的图片
- 同一集内如果发生妆造切换,在切换点的 clip 中同时描述变化过程
5. 否定约束
- 对容易出错的细节用括号内否定(如「短发(非长发、非散发)」)。
- 融入正文或主体定义中,不另设独立块。
自检清单
- 机位/镜头类型/镜头运动是否明确
- 时间点与节奏是否完整
- 构图与空间、光线与色彩、摄影参数是否填写
- 参考图是否绑定且顺序/次数已标注
- 参考图分工:每张图是否只承担一种职责(面部/全身/场景/道具/站位),未混用
- 角色指代:每次角色出镜是否都用了
角色名@图片N 格式,无一遗漏
- 道具指代:有道具参考图时,道具出现是否用了
道具名@图片N 格式
- 末尾是否追加"保持无字幕,避免画面生成字幕,不要水印,不要logo,不要BGM"
- 是否包含角色锚定块
- 是否包含道具锁定行
- 是否包含场景锁定行
- 是否包含至少 1 条否定约束
- 反双胞胎:多角色同画面时,末尾是否追加"视频全程不要在同一画面中复制相同人物,不要多人同脸"
- 范围是否严格限定在当前 15 秒
- 台词转写:文字分镜中的所有角色对白是否已用
{} 格式转写,未被省略或概括
- 音色锚定:有音色参考音频的角色,台词前是否加了
采用音频N的[音色特征描述]的音色(含具体音色特征词,不只写"音频N的音色")
- 场景视频:有场景360度参考视频时,是否在 prompt 中说明"参考视频N中的场景空间布局"
生成提示
- 写完同目录的
视频_ClipXXX.prompt.txt 后,先运行 changdu prompt-optimize --dir ./ --check 检查所有 prompt 是否符合 Seedance 2.0 最佳实践,修复问题后再进行视频生成。
- 使用
changdu prompt-optimize --dir ./ --style '电影写实' 可自动追加画质约束、面部稳定约束和范围边界声明。
- 连续生成模式:使用
changdu sequential-generate 命令时,前一 clip 的尾帧会自动传入下一 clip 作为首帧,保证视觉衔接。因此每个 clip 的提示词开头应自然承接上一 clip 的结尾动作和场景状态,避免突兀跳转。例如上一 clip 结尾角色转身走远,下一 clip 开头应从同一方向和距离开始。
关联技能
- text-storyboard(输入来源)
- generate-film-video-prompt(写作细节参考)
- changdu CLI(统一图像/视频生成入口)
- video-review(生成后连贯性审查与修复)
示例
示例1:动作场景(无台词)
将图片1中的短发、黑色风衣的男子定义为主角。图片2为雨夜老城场景参考。
电影写实风格,雨夜老城石板巷道,路灯昏黄,红蓝霓虹断续闪烁,地面积水形成镜面。
近景开场,黑伞伞沿占画面上半部,雨滴密集砸在伞面,主角@图片1下颌与呼吸白雾闪现,冷蓝霓虹扫过皮肤。紧接着中近景推近,主角@图片1抬眼望向霓虹,眼神紧绷,路灯在面部形成暖黄边光。随后低机位跟拍脚步,鞋尖踩入水坑溅起水花,<水花飞溅声>,镜头轻微抖动。顺势切到手部特写,伞柄握紧至指节泛白,雨水沿伞柄滴落。随后中景侧移,主角@图片1由慢转快奔跑,前景路人模糊掠过。最后全景拉远,主角@图片1冲入更暗的巷段消失在雨幕中,<远处警笛声>。
本段仅展示上述动作,不展示后续剧情。保持无字幕,避免画面生成字幕,不要水印,不要logo,不要BGM。
示例2:对话场景(含台词、音色锚定、反双胞胎)
将图片1中的白皙面容、长直黑发的年轻女性定义为苏棠。图片2为苏棠全身参考。将图片3中的精致妆容、卷发红唇的女性定义为林芷悦。图片4为林芷悦全身参考。
电影写实风格,现代高端医院VIP病房,夜晚昏暗灯光,心电监护仪发出微弱绿光。
推镜头,苏棠@图片1推门回到病房,俯身看着病床上毫无生气的陆衍,眼中满是歉意,采用音频1的低沉坚韧青年女声的音色低声说{对不起……陆衍,对不起}。紧接着门口传来敲门声,林芷悦@图片3抱着百合花站在门口,笑意盈盈走进来,采用音频2的清脆甜腻青年女声的音色说{苏棠姐,这么晚还没休息呢?}。随后苏棠@图片1冷淡地看着林芷悦@图片3,下巴微抬,一字一顿地说{他花粉过敏,你以前就知道,现在装什么?}。特写林芷悦@图片3脸上笑容瞬间凝固,闪过一丝恼怒。
本段仅展示上述动作,不展示后续剧情。视频全程不要在同一画面中复制相同人物,不要多人同脸。保持无字幕,避免画面生成字幕,不要水印,不要logo,不要BGM。
示例3:含道具参考和场景视频的场景
将图片1中的白皙面容、长直黑发的年轻女性定义为苏棠。图片2为苏棠全身参考。图片3为陆家书房场景参考。图片4为黑色U盘道具参考。参考视频1中的书房空间布局,保持人物站位一致。
电影写实风格,台灯昏黄,桌面阴影拉长,室内低反差偏暖。
中近景开场,苏棠@图片1双手紧握U盘@图片4指节泛白,抬头眼中燃起决绝。苏棠@图片1采用音频1的低沉坚韧青年女声的音色沙哑而坚定说{所以,这里面……是他们全部的罪证?}。紧接着陆衍采用音频2的沉稳锐利青年男声的音色冷静说{足够让他们身败名裂。}
本段仅展示上述动作,不展示后续剧情。保持无字幕,避免画面生成字幕,不要水印,不要logo,不要BGM。
生成参数
- 生成视频时再通过视频生成技能传入比例(16:9/9:16)、模型(Seedance 2.0)与参考图清单(角色/场景/道具路径),这些不写进提示词文本。