| name | seedance-25 |
| description | 即梦Seedance 2.5 提示词编写 + 生成执行 + 后期编辑全流程 Skill。适用场景:用户要给即梦/Seedance 2.5 写任何视频生成 prompt(文生视频、图生视频、视频延长、视频编辑、首尾帧生视频、白模走位、一键成片、无缝转场、多宫格分镜)。触发词:sd2.5、sd2.5pro、seedance 2.5、即梦视频、即梦 AI、jimeng、字节视频生成、超长视频、套娃延长、白模动画。 |
| tags | ["seedance","video-generation","jimeng","ai-video"] |
| metadata | {"version":"2.1.0","sources":["飞书文档【即梦】Seedance 2.5 使用手册(2026-07-31 归档)","微信公众号《16000字超详细 Seedance 2.5 官方提示词指南及提示词模板》(小互 AI,2026-08-30 补强归档)"],"revision":"2026-08-30 Darwin 8 维度优化:6 轮 keep,72.8 → 81.8(+9.0);v2.0 全量补强基础上加 Step 化/资源引用/触发词/检查点"} |
Seedance 2.5 使用手册(v2.0 全量补强版)
来源:
使用路径(先看这里)
| 你的需求 | 去哪里 |
|---|
| 写基础提示词(素材+概述+情节+补充) | §四 基础公式 |
| 写真人/去 AI 感人物 | §四 真人人物公式 + §七 去 AI 感 |
| 写 30 秒长视频(含时间戳导戏) | §四 30s 公式 + §二-3 时间戳 |
| 写超长视频(30-180s 一次性直出) | §四 超长公式 |
| 视频延长 / 套娃式续写 | §四 延长公式 + §五 转场库 + §四-延长边界连续性 |
| 编辑已有视频(改物/去 BGM/换背景/改机位) | §四 智能编辑公式(4 Case 完整模板) |
| 白模 / 走位调度(Maya/Blender) | §二-4 白模(粗/细粒度对照表)+ §四 白模公式 |
| 多宫格分镜图驱动成片 | §四 多宫格公式(必写读取顺序) |
| 多素材创作(30 图 + 10 视频 + 10 音频) | §四 多素材公式(4 步编排) |
| 首尾帧独立写法(不依赖首尾帧模式) | §四 首尾帧公式 |
| 多关键帧顺序控制 | §四 多关键帧公式(4 段式) |
| 一键成片(多图+参考视频组接) | §八 一键成片 |
| 无缝转场(两段视频自动补全) | §九 无缝转场(7 步模板 + 5 种方式) |
| 情绪方向可观察表现 | §十 情绪方向(单次 vs 多阶段) |
| 专业摄影术语库 | §十一 摄影术语(7 种热门运镜 + 5 个示例) |
| 生成结果崩坏 / 串脸 / AI 感重 | §七 避坑 + §六 去 AI 感 + §十三 异常处理矩阵 |
| 素材数量 / 时长 / 分辨率参数限制 | §一 速查表 + §十二 能力边界 |
| 非即梦官网平台(fal/Ark 等) | §十三 避坑(局限,2.5 覆盖未验证) |
| 提交前自检 | §十一 提交前检查清单(11 项) |
TL;DR:2.5 核心 = 30s 单次 / 60s 套娃延长 / 180s 超长模式 / 时间戳导戏 / 30图+10视频+10音频参考。所有 prompt 按「素材描述 → 概述 → 情节(带时间戳) → 全局补充」四段式组装。
关联资源:
references/seedance25-manual.md — 飞书原始 198KB 官方手册全文
test-prompts.json — 3 个典型测试 prompt(古装送别 / 视频延长 / 白模动作),用于实测评估
执行检查点(生成前/后各 30 秒核对)
检查点 0|任务分诊(开始前 30 秒,必做)
🛑 人类确认点:先判断任务类型,再决定走哪条公式。
| 用户意图关键词 | 走哪条公式 | 必读章节 |
|---|
| "生成视频 / 写提示词 / 帮我做" + 无明确素材 | §4.1 基础 5 段式 + §4.6 30s 长视频 | 基础 5 段 → 阶段 → 保持一致 |
| "首尾帧 / 关键帧 / 给张图让它动" | §4.11 关键帧 4 段式 | 首尾帧独立 / 多关键帧 4 段 |
| "延长 / 续写 / 接着往后" | §4.9 延长公式 + §五 转场库 | 7 项必保连续性 / 必填词 |
| "改成 / 替换 / 把 X 换成 Y" | §4.8 编辑 4 Case | Case A/B/C/D 匹配场景 |
| "一键成片 / 把这些图做成片" | §4.15 一键成片 | Step 1-5 模板 |
| "白模 / 走位 / 镜头调度" | §二-4 白模 + §4.14 公式 | 粗/细粒度判断对照 |
| "无缝转场 / 两段拼一起" | §九 无缝转场 | 7 步模板 + 5 种方式 |
| "情绪 / 表情 / 表演" | §十 情绪方向 | 单次 vs 多阶段 |
检查点 1|素材交点确认(多素材任务必做)
🛑 人类确认点:素材超过 3 份或人物超过 2 个时,逐张图/@ 视频编号,让用户确认归属。
确认清单:
□ @图1/@视频1/@音频1 是否对应了正确的角色/动作/音色?
□ 是否有素材需要排除(背景人物 / 旧版服装 / 不相关场景)?
□ 跨场景出现的人物是否始终绑定同一组素材?
检查点 2|生成前 11 项检查
生成前:
- □ 素材数量/时长在官方建议区间?(超 1-5 主体 / 5-10s / 20s 编辑时做好抽卡准备)
- □ 参考素材已编号并声明用途?(@图1=人物 / @视频1=动作 / @音频1=音色 / @图X=场景)
- □ 时间戳格式正确?(
[00.0-05.0s] 或 第 N 帧;帧数=秒×24fps)
- □ 禁止项写全?(声音 / 字幕 / 行为 / 易崩坏处,可结尾重申)
生成后验收:
- □ 无随机字幕/BGM?(有 → 在全局补充段重申禁止项后重抽)
- □ 多人场景无串脸/换脸错位?
- □ 局部编辑物理合理?(不合理 → 缩小范围或改文字指令重试)
- □ 延长段动作衔接/转场自然?(生硬 → 补"禁止生硬切镜"约束重试)
- □ 白模动作无僵化?(有 → 换粗颗粒度 / 去掉四肢模型重试)
- □ 关键帧顺序按预期推进?(多关键帧任务必查)
- □ 转场前后画面与声音连续?(延长/无缝转场必查)
一、2.5 vs 2.0 关键升级速查
| 能力 | 2.0 | 2.5 |
|---|
| 单次生成时长 | 4-15s(97-361帧) | 4-30s(97-721帧) |
| 视频延长 | 无 | 单次延长 4-30s,套娃多次累计至 60s |
| 超长视频模式 | 无 | 一次性直出 30-180s |
| 时间戳控制 | 仅先后顺序 | 秒级/帧级精确指令([00.0-05.0s]、第 N 帧) |
| 参考图片数 | 0-9 张 | 0-30 张(单张 <30MB,宽高比 0.4-2.5,300-6000px) |
| 参考视频 | 单个 2-15s,最多 3 个,总 ≤15s | 单个 2-30s,最多 10 个,总 ≤30s(实际 1.8-30.2s) |
| 参考音频 | 单个 2-15s,最多 3 段,总 ≤15s | 单个 2-30s,最多 10 段,总 ≤30s |
| 纯音频驱动 | R2V 不支持仅传音频 | 支持仅传入音频 |
| 输出分辨率 | 480p/720p | 480p/720p(未变) |
| 字幕/BGM 抑制 | 弱 | 大幅优化,负向 prompt 生效 |
| 小语种 | 弱 | 重点优化中/英/西/印尼/马来,覆盖泰/阿/葡/越/日/韩 |
| 多人参考 | 双胞胎问题 | 防串脸/防换脸错位,独立面部特征 |
| 音色参考 | 基础 | 多音色、高保真复刻情绪 |
输入建议(官方):
- 主体数:1-5 个效果最好;6-10 个稳定性下降需抽卡(音视频);主体图 1-8 个,9-12 个需抽卡
- 主体素材时长:5-10s 效果最好
- 视频编辑输入:20s 以内效果好
- 视频参考图编辑:1-5 张效果好,6-8 张需抽卡
-
5 主体时「单视图」更稳;多视角建议拆多张图(多图多视图 > 单图多视图)
二、四大新功能(核心)
1. 🕒 视频延长(套娃式)
- 原视频 ≤30s 才能延长;单次延长 4-30s;产物 ≤30s 可继续延长,极限 60s
- 提示词只作用于新增段,前段画面完全保留
- 三段式导演控制:每段延长可输入新指令(先跑 10s 再指令跳跃)
- 场景:悬念反转、复杂动作接力(拔剑→突刺→收剑)、视角穿越
2. ✌️ 超长视频(30-180s 一次性直出)
- 界面选「超长视频」模式 + 时钟图标调时长(30-180s)
- 长时序一致性:3 分钟跨度人物/服装/场景不"变异"
- 适合:宣传片、完整音乐 MV、情绪独白长镜头
3. 🎯 时间戳文本控制(剧本级导戏)
- 格式:
[00.0-05.0s] 或 第 N 帧(帧率换算:10s=240帧@24fps;720帧=30s)
- 帧级写法:段落用
第 0–90 帧 (0s - 3s) 区间,段内用 第 60 帧 标精确动作点/音效点
- 【全局约束声明】前置块(官方案例结构,强烈推荐):提示词开头统一声明
1.视觉风格 2.字幕限制 3.参考素材映射(@视频1动作/@音频1音乐/@音效2音效/@图片空镜),正文再按帧段推进
- 特殊指令:
注意:仅发声,无字幕(只说台词不显示字幕)
- 多镜头剧情、卡点 MV、分阶段产品展示
- 实测案例:240 帧武侠打斗,24fps 动作准确;2.0 同 prompt 动作连贯性不足
4. 🎬 专业级白模控制(Maya/Blender 插件)
- 粗颗粒度(简单几何体,推荐):白模只做"动态骨架",参考运镜/动作/站位/光影/节奏
- 公式:参考声明 → 对应关系映射(哪个模型=哪个角色)→ 剧情详述 → 场景处理 → 收束
- 最佳实践:不上传有四肢/翅膀的模型(动作易僵化);若有四肢需写出完整动作序列
- 细颗粒度(完整建模):直接渲染材质/光影/风格
- 公式:渲染指令 → 分段渲染描述 → 场景处理 → 收束
- 上传参考视频需去除轨迹线/坐标线/camera cone 干扰信息
- 粗粒度 vs 细粒度判断标准(官方推荐对照表):
| 维度 | 粗粒度白模 | 细粒度白模 |
|---|
| 适合情况 | 用简单几何体预演动作、动线、站位、运镜或切镜 | 已有完整建模,需要更换人物、材质、色彩、场景或风格 |
| 素材要求 | 几何体关系清楚,动作序列完整 | 模型结构完整且画面干净 |
| 必清元素 | 可叠加人物/道具/场景图片 | 避免轨迹线、坐标线、相机锥体 |
| 提示词重点 | 逐一映射白模主体,并说明继承哪些时序与空间信息 | 保持结构、动作和镜头,明确需要重渲染的属性 |
三、多模态参考优化(10 项)
| 功能 | 一句话 | 提示词要点 |
|---|
| 🎵 分离/移除 BGM | 删音乐留人声,画面字幕完好 | "去除背景音乐,保留人物对白" |
| ✨ 迁移创意 | 动作模仿→情绪/镜头语言/网感迁移 | 参考视频的运镜轨迹、色彩逻辑、节奏排版 |
| ✂️ 局部消除与编辑 | 无痕擦除+定向替换 | 框选区域 + "消除右侧路人" |
| 🎥 空间视角修改 | 改机位、外推补全画面外空间 | "改为高空俯拍缓慢推进"、"第一人称视角" |
| 🎙️ 音色参考升级 | 多音色、声线高保真复刻情绪 | "参考@音频1说……保持低沉悬疑语调" |
| 👥 多人参考升级 | 防串脸/换脸错位/穿搭独立 | 明确 A/B 动作与关系 |
| 🟩 无缝绿幕编辑 | 绿幕抠像直接换背景(高精细分割) | "将背景替换为……,光影神秘" |
| 🔗 视频无缝转场 | 两段视频自动补全间隙成一体 | 上传前后两段 + "拼接在一起" |
| 🎞️ 多宫格分镜 | 线稿/火柴人分镜图驱动 | 见下节公式 |
| 🎬 白模控制 | 工业级机位/走位调度 | 见上节公式 |
四、提示词公式(官方全量版)
4.1 基础公式(5 段式)
完整提示词 = 【主体】+【动作或事件】+【场景与环境(可选)】+【视觉风格(可选)】+【运镜或切镜(可选)】+【声音(可选)】
模板:
<主体>在<场景与环境>中<主要动作或事件>。画面呈现<视觉风格>。镜头采用<景别、机位、运镜或切镜>。声音包括<对白、环境声、音效或音乐>。
示例:一名陶艺师在清晨的工作室里完成一只浅蓝色陶杯,将它从转盘上取下并放到木架中央。窗外柔和晨光照入室内,湿润陶土呈现细腻光泽,工作台保持整洁。镜头先以中景记录拉坯动作,再缓慢推近陶杯表面的纹理,最后切到木架正面。保留转盘低沉转动声、陶土摩擦声和轻微室内环境声。
注意:
- 不需要的部分可以省略
- 生成参数不需要写进提示词;可调参数由生成页面或接口设置
- 动作优先概括主要过程,只为关键动作写具体细节,避免重复描述同一动作
4.2 有参考素材时的素材职责声明
素材数量与选择
| 类型 | 输入范围 | 推荐范围 | 扩展上限 |
|---|
| 图片 | 最多 30 张,单张不超过 4K | 主体图片 1-8 个主体 | 9-12 个主体需抽卡 |
| 视频 | 最多 10 段,总时长 ≤30s | 1-5 个主体、单段 5-10s | 6-10 个主体需抽卡 |
| 音频 | 最多 10 段,总时长 ≤30s | 保留直接相关的台词/音色/环境声/音乐 | — |
| 视频编辑 | 可使用视频与参考图共同完成 | 原视频 ≤20s,参考图 1-5 张 | 参考图 6-8 张需抽卡 |
多视角写法:主体图超过 5 个且需要多视角时,把不同视角拆成多张图片(多图多视图 > 单图多视图拼图)。
逐份说明素材职责(必写)
上传参考素材后,必须说明每份素材具体提供什么。素材中的人物、背景或构图容易被误带入成片时,再写明不采用什么。
模板:
@图片1用于<主体>的<外貌、服装、结构或材质>。
@视频1用于<动作、运镜或节奏>。
@音频1用于<角色或声音类型>的<音色、台词、环境声或音乐>。
<主体>在<场景>中完成<主要动作或事件>。
画面呈现<视觉风格>,镜头采用<镜头表达>。
示例:
@图片1用于<陶艺师>的五官、发型和深绿色围裙,不采用图片背景。
@图片2用于<陶艺工作室>的木质工作台、窗户位置和晨间光线,不采用图中人物。
@视频1用于双手拉坯、托起陶杯和放置陶杯的动作节奏,不采用视频中的人物身份、服装和场景。
<陶艺师>在清晨的<陶艺工作室>完成一只浅蓝色陶杯,将它从转盘上取下并放到木架中央。
镜头先以中景记录拉坯动作,再缓慢推近陶杯表面的纹理;
保留转盘转动声、陶土摩擦声和室内环境声。
多视角示例(同一物体多个角度):
@图片1定义同一盏折叠台灯的正面外观。
@图片2定义同一盏折叠台灯的左侧结构。
@图片3定义同一盏折叠台灯的右侧结构。
@图片4定义同一盏折叠台灯的背面结构。
四张图片共同定义同一盏折叠台灯,成片中始终只有一盏折叠台灯。
注意:
- 素材映射关系必须写进提示词——不要只依赖图片中的文字标注,也不要让模型自行判断多份素材分别对应哪个人物、道具或场景
- 当参考视频已经准确给出动作、运镜和顺序时,提示词只需说明继承哪些内容,不必逐动作复述;重复描述可能与素材本身冲突
- 白模视频主要提供运动和空间骨架,仍需要写清希望生成的主体、场景、动作和风格
4.3 声音与文字的特殊字符(5 种符号)
| 用途 | 符号 |
|---|
| 音乐 | · · · |
| 音效 | < > |
| 台词 | { } |
| 字幕 | 【 】 |
示例:
·( )(背景播放舒缓节奏的钢琴乐)
<远处传来钟声>
{你好,欢迎回来}
【第一章:启程】
禁用写法:
无背景音乐,只保留人物对白、环境声和动作音效。
不要字幕。
不要任何声音。
台词语言强化公式
台词不是中文时,建议在台词前明确语言:
女孩用日语轻声说:{もう大丈夫です}
当需要精确控制地区语言习惯时:
台词语言 + 地区变体或口音 + 表达方式 + 说话人 + {台词内容}
示例:
台词语言:美式英语。女孩用自然、口语化的美式英语说:{I thought you weren't coming.}
台词语言:地道的洛杉矶美式英语。年轻男子用自然的洛杉矶口语说:{No way, you actually made it.}
4.4 真人人物公式(去 AI 感核心)
人物 = [年龄/种族] + [肤色/皮肤质感] + [面部细节特征] + [眼神/灵魂] + [发型/发色] + [服装/服装质感] + [体型/情绪/气质]
- 年龄/种族:[具体岁数]+[国籍/人种]+[风格形容词]+[脸型名词]
- 皮肤质感:必须带"保留真实的微细毛孔与肌肤纹理"(可加雀斑/瑕疵)
- 面部细节:眼型+眉骨+鼻梁+唇形+下颌线,至少 3-4 点组合
- 眼神/灵魂:[眼神形容词]+[目光信息/比喻]+[底层情绪]
4.5 多素材创作公式(4 步编排,原文 §2.1)
适用场景:组合使用图片+视频+音频,多人物/多道具/多场景。
4 步流程:
- 逐份素材职责 → 明确每张图/视频/音频负责什么
- 主体映射 → 不同人物/商品/道具分别绑定素材(不要写"@图片1至@图片4分别定义四名角色")
- 按类型整理素材 → 分为【人物】/【道具】/【场景】/【动作与声音】四块
- 主体设定 → 同一人物跨场景使用时,集中描述其完整属性
完整模板:
【人物】
<修复师>对应@图片1,只采用外貌、发型和服装。
<记录员>对应@图片2,只采用外貌、发型和服装。
<布展员>对应@图片3,只采用外貌、发型和服装。
<讲解员>对应@图片4,只采用外貌、发型和服装。
四人的外貌、服装、动作、站位和台词不互相交换。
【道具】
<样本盒>对应@图片5,只属于<修复师>。
<记录板>对应@图片6,只属于<记录员>。
【场景】
<修复室>参考@图片7,只采用空间、材质和光线。
<展厅>参考@图片8,只采用空间、材质和光线。
【动作与声音】
@视频1用于<修复师>打开样本盒的动作,不采用视频中的人物和场景。
@音频1用于<讲解员>的音色和指定台词。
【主体设定:修复师】
外貌与服装:@图片1。
固定道具:@图片5中的<样本盒>。
出现地点:<修复室>和<展厅>。
动作参考:@视频1的开盒动作、@视频2的放置样本动作。
不采用:其他人物的服装,不持有<记录板>或讲解设备。
【场景调用】
场景一|修复室检查
使用:<修复师>、<样本盒>、<修复室>和@视频1的开盒动作。
事件:<修复师>在工作台前打开样本盒并检查内部样本。
结束时:<修复师>停在工作台内侧,样本盒始终位于<修复师>自身右手旁,也就是位于画面左侧。
场景二|展厅登记
使用:<记录员>、<记录板>和<展厅>。
事件:<记录员>在展柜旁核对记录板上的编号。
结束时:记录板仍由<记录员>双手持有,其他人物不进入展柜区域。
核心要点:多素材创作的目标是让模型在当前场景中选择正确素材,不要求所有素材同时出现在画面中。
4.6 30 秒长视频公式(阶段组织,原文 §2.2)
关键原则:事件较多时,把故事拆成连续阶段;每阶段只安排一个主要状态变化,并写清该阶段结束时画面中可以直接看到的状态。
模板:
【生成目标】
生成一段<视频类型>。核心主体是<主体>,主要事件是<故事概要>。
【阶段一】
开始时:<人物、道具和场景的初始状态>。
主要事件:<一个主要动作或事件>。
结束时:<人物位置、道具归属或画面状态>。
【阶段二】
承接上一阶段:<需要保持的状态>。
主要事件:<一个主要动作或事件>。
结束时:<可观察状态>。
【阶段三】
主要事件:<收束事件>。
结束时:<最终画面状态>。
【保持一致】
保持<人物身份、数量、服装、道具归属、空间方向和声音关系>稳定。
示例(花店订单包装流程):
生成一段花店订单包装流程说明视频。<花艺师>和<店员>共同完成花束整理、包装和交付。
【阶段一】
开始时:<花艺师>站在工作台后,桌面放有散开的花枝、剪刀和包装纸。
主要事件:<花艺师>整理花枝并修剪长度。
结束时:花束握在<花艺师>左手,剪刀放回工作台右侧。
【阶段二】
承接上一阶段:两人保持相同身份和服装,花束仍由<花艺师>持有。
主要事件:<店员>展开包装纸,<花艺师>放入花束并系上绿色丝带。
结束时:包装完成的花束平放在工作台中央,丝带结朝向镜头。
【阶段三】
主要事件:<店员>拿起花束并放到取货架上。
结束时:花束只在取货架中央,两人站在工作台后方检查成品。
【保持一致】
保持<花艺师>和<店员>的身份、服装、工作台方向、剪刀位置和花束归属稳定。
时间戳与节奏控制
普通叙事优先使用"阶段"。只有关键交接、进出场、转场或明确节拍需要控制时,再使用以 1 秒为单位的时间表达。
| 表达类型 | 适合场景 | 示例 |
|---|
| 时间区间 | 分配剧情节奏 | 0-5秒:展示空置的木质展示台;一只手放下白色陶盘;结束时手已离开,展示台中央只有白色陶盘。5-10秒:移走白色陶盘,再放下透明玻璃杯…… |
| 明确时间点 | 指定一次关键事件 | 第5秒,镜头快速向左横移并完成转场。 |
| 相对时间 | 描述事件之间的等待关系 | 人物按下按钮3秒后,房间灯光逐渐熄灭。 |
注意:
- 时间段应连续、不重叠
- 时间段表示事件的时间预算,不是精准剪辑点,动作可能在边界附近提前或延后
- 一个时间段中的内容过少会增加模型的发挥空间,内容过多则可能造成过度切镜或剧情遗漏
- 不要用时间戳控制"一秒完成三次动作"等频率
4.7 编辑 / 首尾帧 / 延长任务参数规则(自动锁定)
| 任务类型 | 画幅比例 | 时长 | 其他限制 |
|---|
| 视频编辑 | 自动保持输入视频比例 | 自动基本保持输入视频时长(最大约 0.3s 差异) | 比例/时长不支持另行设置 |
| 首帧或首尾帧生视频 | 自动使用首帧图片的比例 | 支持设置 | 首帧与尾帧应使用相同画幅,避免尾帧被拉伸 |
| 视频延长 | 自动保持输入视频比例 | 支持设置(延长时长) | — |
被自动锁定的参数不能在生成页面或接口中另行指定。
4.8 视频编辑公式(4 Case 完整模板,原文 §2.4)
通用框架:
【编辑目标】编辑@视频1,在<全片或明确时间段>对<画面对象、区域或声音类别>进行<增加、移除、替换或调整>。
【原视频职责】@视频1是唯一编辑母版,负责<人物、场景、动作、构图、镜头、遮挡关系、声音和事件顺序>。
【目标素材职责】@图片1或@音频1用于<目标对象或声音的指定属性>。
【编辑范围】只处理<对象、区域、时间段或声音类别>。
【保持内容】保持@视频1中的<不应变化的画面、动作、声音和时间关系>。
Case A:主体替换
【编辑目标】编辑@视频1,只把<原对象>修改为<目标对象>。
【原视频职责】@视频1是唯一编辑母版,负责原始场景、机位、镜头运动、动作轨迹、遮挡关系和事件顺序。
【目标素材职责】@图片1用于<目标对象>的<外观、结构或材质>,不采用<无关背景、人物或构图>。
【编辑对象与范围】只修改<明确对象和区域>。全片目标对象数量为<数量>。不修改<需要保持的内容>。
【时间线继承】<目标对象>继承<原对象>每次出现、运动、遮挡和离开的时点、持续时长、路径与速度变化。
除以上明确修改对象或区域外,@视频1中的其他人物、道具、场景内容、镜头运动、镜头切换和事件顺序保持原样。
示例:
【编辑目标】编辑@视频1,只把视频中的黄色折叠台灯替换为@图片1中的白色折叠台灯。
【原视频职责】@视频1是唯一编辑母版,负责书桌、书本、手部动作、机位、镜头运动、遮挡关系和事件顺序。
【目标素材职责】@图片1只用于白色折叠台灯的外观、结构和材质,不采用图片中的背景、构图或其他物体。
【编辑对象与范围】全片始终只有一盏白色折叠台灯。只替换原黄色折叠台灯,不修改书本、书桌、手部和背景。
【时间线继承】白色折叠台灯继承原黄色折叠台灯每次出现、转动灯臂、被手遮挡和离开画面的时点、路径与速度变化。
除以上明确修改对象或区域外,@视频1中的其他人物、道具、场景内容、镜头运动、镜头切换和事件顺序保持原样。
Case B:背景替换
@视频1是唯一编辑母版,负责人物、动作、构图、镜头和事件顺序。
@图片1只提供<目标环境>的空间布局、材质、景深、环境色和光线方向,不采用图中的人物或前景物体。
只把@视频1中人物轮廓之外的<原背景区域>替换为@图片1中的<目标环境>。
人物身份、五官、发型、服装、表情、位置、大小和动作保持@视频1。
除以上明确修改对象或区域外,@视频1中的其他人物、道具、场景内容、镜头运动、镜头切换和事件顺序保持原样。
Case C:声音编辑
编辑@视频1,只移除原有背景音乐,保留人物对白、口型、环境声和动作音效;画面内容、镜头和剪辑节奏保持@视频1。
编辑@视频1,把<讲解员>的台词语言调整为自然的美式英语,台词内容和说话时点保持不变;其他人物声音、背景音乐、环境声和画面保持@视频1。
Case D:局部编辑
【编辑目标】编辑@视频1,只在<时间段>把<画面对象/区域>调整为<目标状态>。
【原视频职责】@视频1是唯一编辑母版,负责人物、房间布局、动作、构图、镜头运动、声音和事件顺序。
【编辑范围】只调整<对象或区域>;<关联属性如肤色>随环境光自然变化。
【保持内容】人物身份、服装、表情、位置、动作、房间结构、镜头运动、对白和环境声保持@视频1。
示例:
【编辑目标】编辑@视频1,只在4-7秒把画面右侧墙面的冷蓝色灯光调整为暖橙色灯光。
【原视频职责】@视频1是唯一编辑母版,负责人物、房间布局、动作、构图、镜头运动、声音和事件顺序。
【编辑范围】只调整右侧墙面及其照亮区域的光线颜色;人物肤色随环境光自然变化。
【保持内容】人物身份、服装、表情、位置、动作、房间结构、镜头运动、对白和环境声保持@视频1。
4.9 视频延长公式(边界连续性 7 项必保,原文 §2.5)
核心原则:视频延长是在原视频边界之外继续创作。边界画面应追求视觉上的自然衔接,不应理解为逐像素完全相同。
向后延长(先描述尾帧连续状态 → 再描述延长内容):
@视频1是需要向后延长的原视频。向后延长@视频1。
延长片段的第一个画面直接承接@视频1的尾帧:
保持<主体姿态与朝向>、<道具位置>、<背景与空间关系>、<机位与构图>、<光线>、<声音状态>和<运动趋势>连续。
随后,<描述需要延长的新动作、事件、镜头或声音>。
延长过程中保持<人物身份与服装>、<关键道具>、<背景布局>、<摄影轴线>和<原有声音环境>连续。
同一主体始终保持为同一个连续对象,不重复、不分裂;人物外形或物体部件数量保持稳定。
7 项必保(边界连续性清单):
- 主体姿态与朝向
- 道具位置
- 背景与空间关系
- 机位与构图
- 光线
- 声音状态
- 运动趋势
向前延长(先描述前置内容 → 写清首帧衔接):
@视频1是需要向前延长的原视频。向前延长@视频1。
在原视频开始之前,<描述前置动作、事件、镜头或声音>。
延长片段的最后一个画面自然衔接@视频1首帧:
<主体姿态与朝向>,<道具位置>,<背景与空间关系>;
保持<机位与构图>、<光线>、<声音状态>和<运动趋势>与@视频1首帧一致。
延长过程中保持<人物身份与服装>、<关键道具>、<背景布局>、<摄影轴线>和<原有声音环境>连续。
同一主体始终保持为同一个连续对象,不重复、不分裂;人物外形或物体部件数量保持稳定。
有其他参考素材时(向后延长):
@图片1定义<人物A>的面部特征。
@图片2定义<人物A>的服装。
@图片3定义<关键道具>的结构与材质。
@视频1是需要向后延长的原视频。向后延长@视频1。
延长片段的第一个画面直接承接@视频1尾帧:保持<边界画面与声音状态>连续。
随后,<人物A使用关键道具完成的新动作或事件>。
延长过程中保持<人物A的身份与服装>、<关键道具>、<背景布局>、<摄影轴线>和<原有声音环境>连续。
同一主体始终保持为同一个连续对象,不重复、不分裂;人物外形或物体部件数量保持稳定。
向前延长+其他素材:
@图片1定义<人物A>的面部特征。
@图片2定义<人物A>的服装。
@图片3定义<关键道具>的结构与材质。
@图片4定义两名<布展助理>的灰色工作服。
@图片5定义<展陈准备室>的空间和光线。
@视频1是需要向前延长的原视频。向前延长@视频1。
在原视频开始之前,<人物A完成前置动作或事件>。
延长片段的最后一个画面自然衔接@视频1首帧:
<人物A>的姿态与朝向,<关键道具>的位置与状态,其他人物的站位;
保持<背景与空间关系>、<机位与构图>、<光线>、<声音状态>和<运动趋势>与@视频1首帧一致。
延长过程中保持<人物身份与服装>、<关键道具>、<背景布局>、<摄影轴线>和<原有声音环境>连续。
同一主体始终保持为同一个连续对象,不重复、不分裂;人物外形或物体部件数量保持稳定。
<只在原视频开始后出现的素材>不在向前延长片段中提前出现。
4.10 超长视频公式(30-180s 一次性直出)
【全局参数】(开头重申时长/画幅)+ 【素材描述】+ 【一句话概述】+ 【具体情节描述】+ 【全局补充】
示例:
全程3分钟,@图片1猫咪打工vlog,视频比例16:9……
全程无字幕,无背景音乐。
4.11 关键帧公式(首尾帧独立 + 多关键帧顺序控制,原文 §3.1)
首尾帧独立写法(不依赖首尾帧模式)
模板:
@图片1作为首帧,定义视频开始时的构图、主体位置、姿态、道具状态、场景和镜头方向。
@图片2作为尾帧,定义视频结束时的构图、主体位置、姿态、道具状态、场景和镜头方向。
@图片3用于<主体A>的<外貌、服装、结构或材质>,不改变@图片1定义的首帧构图,不改变@图片2定义的尾帧构图。
@图片4用于<主体B、道具或场景>的<指定属性>,不改变@图片1定义的首帧构图,不改变@图片2定义的尾帧构图。
<描述一个连续动作或事件>。
画面从@图片1定义的首帧自然开始,经过连续动作后到达@图片2定义的尾帧。
首尾之间保持<人物身份、道具结构与归属、场景布局和镜头方向>连续。
每张锚点图需要单独说明——不要合并成"图片1和图片2作为首尾帧"。首帧和尾帧应使用相同画幅。其他参考图只提供指定属性,不替代首尾帧的构图。
多关键帧顺序控制(4 段式)
模板:
以@图片1至@图片N的顺序作为关键帧。
@图片1作为首帧,定义<开始时的构图、主体位置、姿态、道具状态和镜头方向>。
@图片2定义第二个关键帧:<第一阶段结束时的可见状态>。
@图片3定义第三个关键帧:<第二阶段结束时的可见状态>。
@图片N作为尾帧,定义<结束时的构图、主体位置、姿态、道具状态和镜头方向>。
画面依次经过@图片1、@图片2、@图片3至@图片N定义的状态,各阶段之间使用连续动作自然过渡。
全过程保持<主体身份、道具结构与归属、场景布局、光线和摄影轴线>连续。
示例:
以@图片1至@图片4的顺序作为关键帧。
@图片1作为首帧,定义橙色纸飞机静置在教室木桌左侧,机头朝向画面右侧,固定中景。
@图片2定义第二个关键帧:同一架橙色纸飞机被一只手从桌面托起,机头方向不变。
@图片3定义第三个关键帧:同一架橙色纸飞机从窗边掠过,窗帘向右轻微摆动。
@图片4作为尾帧,定义同一架橙色纸飞机落在右侧书架中层,机头仍朝向画面右侧。
画面依次经过@图片1、@图片2、@图片3和@图片4定义的状态,各阶段之间保持飞行方向和速度连续。
全过程保持纸飞机的橙色材质、大小与折痕,教室布局、午后侧光和镜头轴线连续。
重要:独立关键帧通常比把多个画面拼在一张宫格图中更容易对齐,但它控制的是阶段顺序和关键状态,不等于逐帧复刻。
4.12 宫格分镜公式(必写读取顺序,原文 §3.1)
模板:
@图片1提供<N格宫格分镜>的镜头顺序和大致构图,按照<从左到右、从上到下>的顺序读取;
不采用图中的<线稿画风、文字标注或占位人物>。
@图片2定义<主体A>的<外貌与服装>。
@图片3定义<关键道具或场景>的<结构、材质或光线>。
镜头1:<景别、主体动作、场景状态>。
镜头2:<景别、主体动作、运镜或切换方式>。
……
镜头N:<结束动作和结束画面状态>。
最终画面采用<视觉风格>,声音包括<对白、环境声、动作音效或音乐>。
建议:
- 控制在 15 格以内
- 使用简洁线稿或干净示意图,减少文字标注
- 明确读取顺序,再写出每格的主体动作、景别或运镜、最终画风和声音
4.13 多宫格分镜公式(强化版)
- 先介绍分镜指代(每个分镜=一个镜头,非人物/场景)
- 主体设定(引用参考图详述角色)
- 分镜头描述(故事梗概逐镜补齐,控构图/景别/运镜/动作,带时间戳如
镜头1(0-3s))
- 其他:全局风格、禁止项(禁止换脸变形/新增无关人物等)
4.14 白模公式(粗粒度 + 细粒度)
粗粒度白模
@视频1是粗粒度白模参考,仅提供<动作路径、人物站位、机位、运镜、切镜、光影变化、声音节奏或空间关系>,不采用其中的白模外观、材质和场景。
@视频1中的<白模主体A>对应<主体A>。
@视频1中的<白模主体B或几何道具>对应<主体B或关键道具>。
@图片1定义<主体A>的<外貌、服装或结构>。
@图片2定义<主体B、关键道具或场景>的<指定属性>。
<主体>在<场景>中完成<主要动作或事件>。
保持@视频1中的<动作路径、站位、运镜、切镜、光影或声音节奏>。
最终画面采用<人物、场景、材质和视觉风格>,声音包括<对白、环境声或动作音效>。
白模信息 → 需要说明的内容:
| 信息维度 | 需要在提示词中说明 |
|---|
| 动线 | 动作轨迹、运动方向、人物站位和进出场顺序 |
| 运镜 | 机位、镜头路径、运动方向和速度变化 |
| 光照 | 光线方向、明暗变化和变化发生的时机 |
| 切镜 | 切镜位置,以及切镜前后的主体与构图 |
| 声音 | 是否继承对白、音乐、环境声或动作音效 |
注意:优先使用关系清楚的简单几何体。手臂、翅膀等附属结构只有在动作序列完整时才适合作为白模信息,否则容易造成动作僵硬或结构误判。
细粒度白模
@视频1是细粒度白模参考,保持<主体结构、动作、空间布局、机位、运镜和切镜>,不采用原有灰模材质和空白背景。
@图片1定义<主体>的<人物形象、材质、颜色或表面细节>。
@图片2定义<场景>的<空间、材质、光线或视觉风格>。
将@视频1中的<主体>重渲染为<最终主体>,场景重渲染为<最终场景>。
保持@视频1中的<结构、动作、镜头和空间关系>,画面呈现<材质、色彩和风格>,声音包括<环境声、音效或音乐>。
4.15 一键成片公式(原文 §3.2,新增章节)
适用场景:把多张图片,或图片与风格参考视频,组织成具有统一节奏和包装风格的完整视频。
核心原则:提示词需要说明每份素材的职责、图片顺序、画面动态、剪辑节奏、视觉包装和声音;不要只写"把这些素材做成视频"。
5 步编排顺序(显式 Step 编号,便于检索):
| Step | 步骤 | 关键产出 |
|---|
| Step 1 | 素材职责 | 每份图/视频具体提供什么(@图片1 用作 X / @视频1 仅用作 Y) |
| Step 2 | 图片顺序 | 逐张写明出现顺序(按 @图片1-@图片N 顺序 / 自由编排) |
| Step 3 | 动态幅度 | 每张图的运动幅度(轻微 Live 动效 / 视差 / 推拉 / 横移 / 局部动作) |
| Step 4 | 剪辑风格 | 节奏、转场、字幕、图形包装、色彩 |
| Step 5 | 声音 | 对白、环境声、音效、音乐 |
模板:
【素材职责】
@图片1用于<人物、商品、场景或开场画面>。
@图片2用于<人物、商品、场景或过程画面>。
@图片3用于<人物、商品、场景或结尾画面>。
@视频1仅用于<剪辑节奏、转场、字幕包装或音乐风格>,不采用其中的人物身份和场景(可选)。
【编排方式】
图片按照<上传顺序、指定顺序或主题自由编排>出现。
<说明需要保持的人物、商品、地点和事件关系>。
【画面动态】
每张图片采用<轻微Live动效、视差、推拉、横移或局部动作>。
保持<主体外观、商品结构、文字或背景关系>稳定。
【成片风格】
采用<剪辑节奏、转场方式、字幕或图形包装、色彩风格>。
【声音】
包括<对白、环境声、音效或音乐>。
示例(夜市旅行短片):
【素材职责】
@图片1用于夜市入口和开场环境。
@图片2用于<旅行者>沿街行走的画面。
@图片3用于灯笼摊位和手工艺细节。
@图片4用于三位朋友围桌用餐。
@图片5用于河边夜景和倒影。
@图片6用于三人在桥边合影的结尾画面。
@视频1仅用于轻快剪辑节奏、手绘贴纸和转场方式,不采用其中的人物身份与地点。
【编排方式】
画面按照@图片1至@图片6的顺序出现,形成"到达夜市、沿街游览、用餐、散步、合影"的完整过程。
保持三位朋友的外貌与服装稳定,不互相混合。
【画面动态】
环境图片采用缓慢推近和轻微视差;人物图片只增加自然眨眼、转头、举杯和衣物随风摆动。
保持摊位结构、餐桌位置和桥边栏杆稳定。
【成片风格】
采用明快的旅行短片节奏,场景之间使用自然遮挡和相近色彩衔接,手绘贴纸只出现在画面边缘。
【声音】
保留夜市人声、餐具轻响和河边风声,配合轻快但不过分抢眼的器乐音乐。
注意:图片顺序重要时,应逐张写明出现顺序;允许模型自由编排时,也要明确写出"可按主题自由编排"。涉及多个人物或多个商品时,仍需逐一命名并绑定素材。
五、转场库(切镜/延长时用)
| 类型 | 说明 | 适用 |
|---|
| 自然镜头切换 | 强调呼吸感、留足切换时间 | 常规叙事 |
| 淡入淡出 | 全黑/全白浮现或暗去 | 开头结尾、"第二天" |
| 叠化 | 1-2s 柔和重叠交融 | 回忆/梦境/抒情 |
| 白闪/黑闪 | 瞬间闪白/闪黑 | 卡点/紧张氛围 |
| 遮罩转场 | 物体遮挡镜头→穿出 | 空间穿越 |
| 水墨转场 | 水墨风格过渡 | 国风 |
| 相似物转场 | 形状匹配 | 创意衔接 |
| 焦距/旋转变装/俯冲转场 | 视觉冲击 | 混剪/变装挑战 |
六、去 AI 感实战要点
- 追求真实感:"原生皮肤质感"、"毛发根根分明"
- 长尾动作(高难度/不常见动态:特殊舞蹈、复杂武术、细微神态):描述完整动态链("武术家在雨中后空翻,落地拔剑,雨水顺剑刃滑落")
- 多镜头一致性:保持角色基本特征描述贯穿所有镜头
- 去字幕/BGM:"纯净视频,无字幕,无背景音乐"(2.5 已大幅优化响应)
- 多语言:直接母语写 prompt + 写目标语言台词(成片文字可指定"所有文字必须全部为韩文")
- 电商分栏模板可用参考图锚定版式:"参考图作为风格和版式锚定,保持分栏边框样式、字体排版、光影质感全程统一"
七、避坑记录(官方承认的局限 + 实测)
- 白模粗颗粒度优先;细颗粒度需干净无干扰的模型视频
- 主体/素材超量时稳定性下降,需抽卡(官方承认)
- 局部消除偶发物理不合理(案例:消除人物后帽子掉落无征兆)——复杂交互需抽查
- 输出分辨率仅 480p/720p,4K 需后期(用户 12GB 显存可本地 LTX 升分辨率)
- 超长视频模式适合一次性长片;短片多次套娃延长可精确控制每段内容
八、一键成片(详见 §4.15)
本节为路径快捷入口;完整公式 + Step 1-5 模板 + 示例见 §4.15 一键成片公式。
九、无缝转场(原文 §3.3 完整覆盖,7 步模板)
十、情绪方向与可观察表现(原文 §3.4)
核心原则:只写"紧张、温馨、压抑"等情绪词,模型可以理解整体方向,但具体表演方式会有更多发挥空间。如果希望稳定控制人物演技,建议写明眼神、眉头、嘴角、呼吸、视线和手部动作等能够直接看到或听到的表现。
不必罗列所有面部细节。单次情绪转折通常选择 2 至 4 个最明确的表现即可;只有当情绪包含多次转折时,才需要按触发事件分阶段描述。
单次情绪转折(默认写法,Step 1-4)
Step 1|整体情绪:从<起始情绪>转为<结束情绪>。
Step 2|触发:发生<触发事件>后,<主体>先出现<即时可观察反应>。
Step 3|递进:随后,<眼神、眉头、嘴角、呼吸、视线或手部动作>逐渐发生<变化>。
Step 4|收束:最终,<主体>以<克制或明确的外在表现>表达<目标情绪>。
多阶段情绪(按触发事件递进,Step 1-3)
Step 1|第一次触发:听到或看到<第一个触发事件>时,<主体的第一个可观察反应>。
Step 2|第二次触发:当<第二个触发事件>出现后,<主体的表情、视线或呼吸发生的变化>。
Step 3|确认后:确认<关键信息>后,<主体试图克制或掩饰的情绪>通过<可观察表现>逐渐显现。
(可选 Step 4|最终动作:<主体的最终动作、表情或说话方式>。)
示例:
舞台后方传来演出结束的掌声。
年轻演员握住节目单的手指突然停住,视线缓慢转向幕布方向,肩膀仍然紧绷。
确认谢幕后,她先轻轻呼出一口气,肩膀逐渐放松,嘴角浮现克制的微笑,眼眶慢慢湿润,但始终没有转身离开。
十一、专业摄影术语(原文 §3.5)
基础镜头语言
| 类别 | 术语 |
|---|
| 景别 | 大全景、全景、中景、近景、特写 |
| 运镜 | 推、拉、摇、移、跟、环绕、俯冲、后拉、上摇、手持晃动 |
| 机位与视角 | 低角度、俯视、第一人称 |
7 种热门运镜(可直接使用,Step 编号)
| Step | 运镜 | 必填字段 | 典型示例 |
|---|
| Step 1 | 一镜到底 | 镜头连续经过的主体 + 空间 + 事件顺序 | "镜头从咖啡馆门口一路跟随<主角>穿过吧台、过道、储物间,最后停在二楼窗前" |
| Step 2 | 希区柯克变焦 | 主体保持的大小 + 背景空间被拉近/推远的效果 | "<主体面部>始终保持原大,背后的走廊空间被缓慢拉近" |
| Step 3 | 航拍视角 | 俯视高度 + 移动方向 + 环境范围 | "镜头从<山顶>200 米高度沿山脊向北推进,覆盖整片原始森林" |
| Step 4 | FPV | 第一人称飞行/穿行路径 + 速度 + 转向 | "FPV 镜头从<地铁站入口>高速冲入,连续穿越闸机、扶梯、月台,最后冲出隧道" |
| Step 5 | 子弹时间 | 被冻结/放慢的动作 + 镜头环绕方向 | "<子弹>出膛瞬间被冻结,镜头以 360° 弧线环绕主体" |
| Step 6 | 手持镜头 | 跟拍对象 + 晃动程度 | "镜头紧跟<记者>穿过人群,轻微晃动模拟奔跑节奏" |
| Step 7 | 回弹变速 | 加速/减速/回弹节点 + 最终停留状态 | "<滑板>在第 3 秒突然减速回弹,最后停在画面左侧" |
注意:术语较少见、可能存在多种理解,或需要精确控制画面变化时,应同时说明术语作用于谁、画面如何变化,以及希望看到的结果。
小众摄影术语(必须翻译成画面变化)
公式:专业术语 + 作用主体 + 画面变化 + 前/背景关系 + 方向或速度
示例:
移焦:焦点从前景树叶平滑转移到背景人物。树叶逐渐虚化,背景人物的面部由模糊变得清晰。
5 个摄影表达示例
| 示例 | 写法 |
|---|
| 1. 浅景深人像 | <糕点师>的眼睛和面部保持清晰,身后的玻璃罐和灯光虚化成柔和圆形散景。 |
| 2. 追随摄影 | 镜头与<滑板者>同速水平移动,人物保持清晰,街边墙面形成从右向左的水平拖影。 |
| 3. 黄金时刻 | 暖色低角度阳光从<登山者>左后方照入,山脊地面形成较长阴影。 |
| 4. 自然暗角 | 画面四角逐渐变暗,中心<钢琴演奏者>的亮度和肤色保持正常,不出现黑色边框。 |
| 5. 甩镜转场 | 第5秒镜头快速向左横移;前景书架完成整屏遮挡时切换到下一场景,切换后镜头继续保持向左运动和相近速度。 |
注意:光圈、焦距和快门数值可以写入提示词,但最终画面的可见结果通常比单独写一个数值更明确。
十二、能力边界(原文 §5,9 条限制)
这是 2.5 当前的能力边界,使用时必须遵守;超出会导致结果不可控。
- 时间戳只能用于分配事件节奏,不是帧级剪辑点——动作可能在边界附近提前或延后
- 视频编辑提示词可以提高关键事件与原视频对齐的概率,但不能保证逐帧完全重合
- 多素材创作的重点是正确选择和组合素材,不是让所有素材同时出现
- 必须完全准确的字幕、公式、标牌、产品参数和帧级时间点,建议通过前期合成好的素材+视频生成+后期制作完成
- 视频编辑会锁定输入视频比例和基本时长——这两项不支持另行设置;输出时长与输入视频可能有最大约 0.3 秒的差异
- 首帧或首尾帧生成会以首帧画幅锁定比例,时长可以设置;首尾图比例不同可能使尾帧出现拉伸
- 视频延长会锁定输入视频比例,延长时长可以设置;延长片段的音量可能与输入视频存在轻微差异
- 一键成片中,如果图片顺序或人物对应关系重要,需要在提示词中明确指定
- 视频无缝转场追求视觉与声音连续,不代表两段原视频能够逐像素保持不变
十三、提交前检查清单(11 项,原文 §4)
提交生成前,逐项核对以下 11 条;任一不满足就先改 prompt,不浪费抽卡次数。
- 主体与事件:是否说清楚了主体和主要动作或事件?
- 素材职责:每份参考素材是否明确说明采用什么、不采用什么?
- 人物道具命名:不同人物、商品和道具是否逐一命名并绑定素材?
- 多素材场景选择:多素材是否按场景选择,而不是要求全部同时出现?
- 长视频阶段:长视频的每个阶段是否只有一个主要变化,并写清结束状态?
- 一致性:人物数量、服装、道具归属和空间关系是否稳定?
- 视频编辑四要素:是否明确唯一母版、修改范围、目标数量和保持内容?
- 情绪与术语翻译:抽象情绪和摄影术语是否对应了可以直接看到或听到的表现?
- 关键帧与首尾帧:首尾帧和多关键帧是否逐张说明职责,首帧与尾帧是否使用相同画幅?
- 白模与分镜:宫格分镜是否写清继承的结构;白模是否先判断粗粒度或细粒度,并写清需要继承的时序、结构、材质和风格?
- 任务参数锁定:视频编辑、首尾帧生成和视频延长是否遵循自动锁定的比例与时长规则?视频延长是否同时检查边界画面、运动趋势和声音连续性?一键成片是否说明素材职责、图片顺序、动态幅度、剪辑风格和声音?无缝转场是否写清两段视频的职责、触发动作、过渡过程和到达状态?
十四、异常处理矩阵(fallback)
| 异常 | 处理 |
|---|
| 平台只有 2.0(fal/Ark/第三方路由) | 切 seedance-20 技能流程:参考图≤9/视频≤3/音频≤3,单次≤15s,无时间戳/白模/绿幕/超长 |
| 多参考+4K 任务挂死 | 超 5 分钟无输出即中止;切 t2i 无参考 + 详细文字描述重做(RunningHub 实测教训) |
| 主体/素材超量崩坏 | 先降载到 1-5 主体 / 5-10s / 20s 内,再考虑抽卡(§一 输入建议) |
| 白模动作僵化 | 换粗颗粒度 + 不上传四肢/翅膀模型;或用文字写全四肢动作序列 |
| 局部编辑物理不合理 | 缩小编辑范围或改文字指令重试;接受后人工剪辑修补 |
| 仍带字幕/BGM | 在全局补充(结尾)段重复禁止项——模型对结尾强调响应更好 |
| 输出分辨率不足 | 本地 LTX-2.3 升分辨率(12GB 显存可跑 1080p) |
| 参考素材超限 | 2.5 上限:30 图 / 10 视频(≤30s) / 10 音频(≤30s);超了分批或抽关键帧 |
| 多关键帧顺序错乱 | 改为关键帧 4 段式(首帧/中间帧/尾帧/连续)+ 重抽 |
| 转场生硬/不连续 | 补"延长自然、动作衔接流畅、禁止生硬切镜"约束 + 检查 7 项边界必保 |
| 多人串脸 | 显式分组命名(【人物】/【道具】/【场景】)+ 不采用其他人物的服装 |
十五、版本与来源
| 版本 | 日期 | 主要变化 | 来源 |
|---|
| 1.0 | 2026-07-31 | 初版归档(飞书官方手册) | 飞书【即梦】Seedance 2.5 使用手册 |
| 2.0 | 2026-08-30 | 全量补强:新增 §4.5 多素材 4 步 / §4.8 编辑 4 Case / §4.9 延长 7 项必保 / §4.11 首尾帧独立 + 多关键帧 / §4.15 一键成片 / §九 无缝转场 7 步 / §十 情绪可观察 / §十一 摄影术语 7 种运镜 / §十二 能力边界 9 条 / §十三 提交前 11 项检查 | 微信公众号《小互 AI》转载的官方提示词指南 |
END OF SKILL