| name | tt-creative-video |
| description | Use when a user wants visual-style direction, visual metaphors, first-frame and last-frame image prompts, or video prompts for a short creative video, B-roll clip, spoken line, opinion, or abstract idea, including “创意视频 prompt”, “视频视觉风格”, “视觉隐喻”, “首尾帧 prompt”, “一图双帧”, “双图端点”, “creative video prompt”, “拼贴类型”, “黏土类型”, “黏土动画”, “毛毡类型”, “布艺”, “织物定格”, “collage”, “claymation”, “felt animation”. |
Creative Video Prompts
把短视频想法转换为经过用户确认的视觉风格、视觉隐喻,以及可直接复制的首尾帧图片 Prompt 与视频 Prompt。只设计 Prompt,不生成媒体。
Required references
- Gate 1 推荐风格前,读取
references/style-selection.md。
- 具体风格确认后,只读取该表
确认后读取 列指定的一个风格契约。
- 不要为了比较而读取任何具体风格文件;不要一次加载全部风格契约。
输入完整度路由
先判断用户已经明确决定了什么,不要要求用户重复确认其已锁定的内容:
- 只有创意概念,未指定支持的具体风格:进入 Gate 1。
- 只指定风格族:按 Gate 1 的风格族规则推荐具体风格并等待确认。
- 已指定支持的具体风格,但视觉隐喻、开场或结尾仍未确定:进入 Gate 2。
- 已指定支持的具体风格,并明确核心表达或视觉命题、开场状态、结尾状态:视为风格与隐喻均已确认,读取对应风格契约后直接进入 Gate 3。
- 用户提供完整分镜、具体风格与核心表达时,保留其锁定条件,不另加隐喻候选或改写叙事逻辑。
- 用户明确要求直接生成媒体:退出本 prompt-only 流程,改用实际媒体生成能力。
Gate 1:确认视觉风格
用户只给视频想法时,提取主题、情绪、节奏与明确限制,跨风格族推荐最匹配的 3 个具体风格,并以 风格族 → 具体风格 标示。用户只指定风格族时,只在该族内推荐;该族只有一个具体风格时呈现一个候选,然后停止并等待确认,不虚构其他候选。每种包含:
- 风格名称
- 推荐理由
- 视觉特征
- 色彩方向
- 运动语言
- 与当前想法的结合方式
- 一项主要风险或取舍
输出后停止。此阶段不提供视觉隐喻、图片 Prompt 或视频 Prompt。
用户修改候选时继续停留在 Gate 1。只有用户明确指定支持的具体风格正式名称或 style-selection.md 登记的具体风格别名时,才视为风格已确认;读取表中指定的契约后,按输入完整度路由进入 Gate 2 或 Gate 3。风格族请求始终停留在 Gate 1,即使该族当前只有一个具体风格。
Gate 2:确认视觉隐喻
读取所选风格文件,提供 2–3 个方向。每个方向包含:
- 核心意思
- 情绪
- 一句话视觉命题
- 关键主体与物件
- 开场状态
- 结尾状态
- 核心变化动作
- 构图与色彩建议
输出后停止。此阶段不提供图片 Prompt 或视频 Prompt。只有用户明确选择或确认一个隐喻后才能进入 Gate 3;用户输入已经同时明确核心表达、开场和结尾时,视为已完成该确认。
Gate 3:合并交付
按顺序输出且只输出以下三个一级标题:
图片 Prompt
视频 Prompt
建议上传的图片
两个生成 Prompt 都必须自包含,不得引用“上述风格”“已确认的隐喻”或聊天上下文。只保留实现用户意图所需的信息,不擅自增加叙事物件、角色、文字或转折。
信息按以下优先级组织:用户锁定条件、构图与摄影机不变量、首尾状态、核心动作、风格细节、Avoid。发生冲突时保留更高优先级内容。
图片 Prompt 内部顺序
把完整图片 Prompt 放在一个独立代码块中,按以下顺序书写:
- 任务、主题、视觉隐喻、风格、画幅
- 共享不变量:场景、色彩、材质、纹理、构图、光影、锁定摄影机、构图锚点与落位区域
- 参考图版式或端点输入方式
- 开场静态状态
- 结尾静态状态
- 文字规则
- Avoid
图片 Prompt 描述冻结瞬间和视觉状态,不把连续运动过程塞入静帧要求。
视频 Prompt 内部顺序
把完整视频 Prompt 放在一个独立代码块中,按以下顺序书写:
- 任务、主题、视觉隐喻、风格、时长、画幅
- 参考图的角色与提取方式
- 场景、色彩、材质、构图、光影与摄影机不变量
- 按时间或阶段排列的动作
- 运动语言、节奏与结尾停留
- 用户需要时提供可选声音 Brief
- 文字规则
- Avoid 与端点版式禁令
未确认视频模型支持音频时,把声音要求标为可选声音 Brief,不暗示声音一定会由视频模型生成。
时长遵循用户输入;未指定时约 10 秒。画幅遵循用户输入;未指定时为 9:16。
默认端点:一图双帧
除非用户明确要求生成两张图片,输出一个 two-panel reference sheet 图片 Prompt:
- 左格是完整的 9:16 开场帧,右格是完整的 9:16 结尾帧。
- 两格等宽等高,整张约 9:8,中间只有共享背景形成的窄 gutter。
- 先定义共享不变量:画幅、锁定摄影机、构图锚点、落位区域、场景、色彩、光影、材质、纹理与文字规则。
- 再分别描述左格与右格的状态差异。
- 左格保留尾帧所需的准确负空间与落位区域。
- 图内没有面板标签、序号、箭头、说明文字或可见边框。
使用以下固定素材命名,避免不同生成阶段的 Image 1 冲突:
Source Image A:用户提供给图片模型的人像、物件或材质素材。
Generated Endpoint Sheet:图片模型依据图片 Prompt 生成的一图双帧参考图。
Reference Image 1:把 Generated Endpoint Sheet 上传到视频模型后的名称。
视频 Prompt 必须把 Reference Image 1 定义为参考图而非视频画面,提取其左格内部构图作为全屏开场,忽略横向画布、gutter 与分屏结构,按顺序完成变化,再以右格内部构图作为全屏结尾并短暂停留。
视频始终是单一全屏画面。明确包含:
no split screen, no diptych layout, no side-by-side panels, no gutter, no border, no panel labels, no storyboard sheet visible in the video
这是模型无关的故事板约定,不保证精确锁定首尾帧。
明确例外:双图端点
仅在用户明确说“生成两张图片”“分别生成首尾帧”,或指定模型要求两个端点输入时,输出:
- 一个独立、自包含的首帧 Prompt
- 一个独立、自包含的尾帧 Prompt
两个 Prompt 都重复全部共享视觉不变量。将生成的首帧上传到视频模型后称为 Reference Image 1,尾帧称为 Reference Image 2;视频 Prompt 明确前者是开场端点,后者是结尾端点。
建议上传的图片
按生成阶段说明素材,不混用编号:
- 图片生成阶段:列出需要作为
Source Image A 等输入的用户素材;无需素材时明确写“无需上传”。
- 视频生成阶段:默认上传图片模型生成的
Generated Endpoint Sheet,并在视频 Prompt 中称为 Reference Image 1。
- 双图端点模式:上传生成的首帧和尾帧,分别称为
Reference Image 1 与 Reference Image 2。
- 不建议与用户意图无关的素材,不编造用户已经拥有的图片。
状态修订
- 修改风格候选:停留在 Gate 1。
- 修改视觉隐喻:停留在 Gate 2。
- 批量任务只推进已确认条目。
- Gate 3 后修改风格:回到 Gate 1。
- Gate 3 后修改隐喻:回到 Gate 2。
- 只修改措辞或端点格式:直接重写 Gate 3。
- 用户催促不构成跳过确认的授权。
边界
- 不调用图片或视频生成工具。
- 不创建媒体、项目目录、contact sheet 或 QA 文件。
- 不运行 API、模型、Python、ffmpeg 或环境检查。
- 不宣称模型具有未确认的端点锁定能力。
- 用户要求直接生成媒体时,改用实际媒体生成能力,不继续本 prompt-only 流程。
常见错误
- Gate 1 就输出故事内容:删除隐喻与 Prompt,只保留当前路由要求的风格候选;概念请求为 3 个,风格族请求最多 3 个,单成员风格族为 1 个。
- Gate 2 未确认就输出 Prompt:回到隐喻候选并停止。
- 默认输出两个图片 Prompt:恢复为一个一图双帧 Prompt。
- 一图双帧进入视频画面:强化抽取单格、全屏化与禁止分屏约束。
- Prompt 依赖聊天上下文:在每个 Prompt 内补齐全部视觉不变量。
- 混用风格契约:只采用已确认具体风格文件中的视觉签名。
- 用户已给完整方案仍重复提问:按输入完整度路由跳过已完成的确认。
- 素材编号冲突:使用 Source Image、Generated Endpoint Sheet 与 Reference Image 命名。
- Prompt 冗长失焦:按信息优先级删除低优先级装饰,不删用户锁定条件。