| name | outfit-director |
| description | 为女性、男性或宠物设计“同一主体多套造型拼贴首帧 + 换装视频”,输出参数锁定、图片提示词、完整时间轴、精简视频提示词和负面约束。用户提到换装导演、人物或宠物换装、穿搭拼贴、悬浮贴纸、点击/飞入换装、8–10 秒卡点变装、15 秒换装舞蹈、7 套造型、上传参考图延展,或先推荐服装方案时使用。
|
换装导演
目标
把一次换装需求转换为彼此联动的:
- 路由判定与参数锁定
- 拼贴首帧图片提示词
- 完整视频时间轴
- 可直接复制的精简视频提示词
- 负面提示词与强制约束
图片是视频的结构母图。视频必须继承主体身份、全部造型、侧边贴图位置、画面布局与摄影质感。
工作流程
- 先执行主体路由:女性、男性、宠物或混合合集;判断复杂、涉及宠物或混合合集时读取
references/subject-routes.md。
- 再执行视频路由:卡点换装或换装舞蹈。
- 锁定用户明确给出的参数;只补全低风险缺失项。
- 需要服装方案时读取
references/parameter-presets.md。
- 需要选择或改造转场时读取
references/transition-library.md。
- 生成首帧提示词,再依据首帧结构生成视频时间轴。
- 最后执行数量、时长、贴图消失、身份一致性检查。
不要重复询问已知信息。仅在主体类别、造型方向或互相冲突的高影响参数完全无法推断时,问一个简短问题。
主体路由
按以下优先级判定:
- 用户明确指定的主体类别
- 上传参考图中清晰可见的主体
- 用户文本中的角色、性别、物种或品种
- 均缺失时默认原创中国成年女性
女性路线
- 无参考图且未指定国籍 / 族裔外观时,默认原创中国成年女性,视觉年龄 22–28 岁,自然真实的东亚面部特征。
- 明确锁定脸型、五官、肤色、妆容、眼睛、发型、发色、身材比例与整体气质。
- 不使用服装或文化符号代替族裔外观,不自动生成欧美面孔。
男性路线
- 无参考图且未指定国籍 / 族裔外观时,默认原创中国成年男性,视觉年龄 22–30 岁,自然真实的东亚面部特征。
- 明确锁定脸型、五官、肤色、胡须状态、发型、发色、体型比例与整体气质。
- 服装和动作可阳光、都市、学院、商务、运动、国风或用户指定,不套用女性妆容与姿态模板。
宠物路线
- 锁定物种、品种或混种特征、成年/幼年阶段、体型、毛色、花纹、眼睛、耳形、口鼻、尾巴和项圈等识别锚点。
- 不写国籍、族裔、妆容或人类身材比例。
- 默认保持真实动物解剖与四足运动;除非用户明确要求,不拟人化站立或舞蹈。
- 服装必须适体、安全,不遮挡眼睛、鼻子、嘴巴,不束缚颈部、胸腔、四肢与尾巴。
- 宠物“舞蹈”默认解释为节拍化转圈、抬爪、侧步、坐立、歪头等自然动作组合。
混合合集路线
- 用户明确要求女性、男性与宠物合集时,分别生成独立子方案;不得把人物身份一致性强行跨主体套用。
- 每个子方案独立执行主体锚点、首帧、时间轴和负面约束。
- 未明确要求同框时,默认分成多个独立视频,避免一条视频中主体数量和造型路由冲突。
视频模式路由
模式 K|卡点换装
触发词:卡点、点击换装、贴纸飞入、快速变装、8 秒、9 秒、10 秒。
- 时长限定 8–10 秒;用户未指定具体值时使用 9 秒。
- 默认 5 套造型:中央初始造型 + 4 个侧边造型。
- 默认固定机位,优先保证换装因果与动作连续。
- 默认加入有清晰重拍的卡点背景音乐;必要转场音效可轻量叠加。用户说“仅背景音乐”时禁止额外音效。
- 用户明确指定 3–7 套造型时可调整数量与布局,但时长仍保持 8–10 秒。
- 默认完成点(9 秒):1.35、3.05、4.85、6.85 秒;最后至少保留 1.5 秒展示最终造型。
模式 D|15 秒换装舞蹈
触发词:换装舞蹈、跳舞、舞蹈编排、dance、15 秒。
- 时长固定 15 秒。
- 造型固定正好 7 套:中央初始造型 1 套 + 左侧 3 套 + 右侧 3 套。
- 中央主体必须全身站在画面中间,双脚活动区稳定,不漂移出中心区域。
- 左侧上 / 中 / 下各放 1 个完整主体贴图;右侧上 / 中 / 下各放 1 个完整主体贴图。
- 六个侧边贴图分别穿不同服装并采用不同舞蹈关键姿势;脸、发型、体型或宠物识别锚点始终一致。
- 默认激活顺序为左上 → 右上 → 左中 → 右中 → 左下 → 右下,以保持视觉平衡。
- 默认换装完成点为 2.0、4.1、6.3、8.5、10.8、13.0 秒;13.0–15.0 秒展示最终造型并完成收尾动作。
- 每次在舞蹈动作峰值换装,连续完成六次变装;不得切成七段彼此无关的独立动作。
- 默认只使用卡点背景音乐,不加点击声、飞入声或换装音效;用户明确要求时再添加。
- 默认固定正面全身机位;可轻微呼吸式推近,但不得影响七个主体的首帧识别和中央舞蹈连续性。
当“卡点”和“舞蹈”同时出现时:若用户强调连续舞蹈或 15 秒,选择模式 D;否则选择模式 K。用户明确要求两版时分别输出,不混成一条时间轴。
工作模式
直接生成
已有参考图、角色设定或足够服装信息时,直接输出完整结果,不重复提问。
参数推荐
用户说“原创推荐”“先给方案”“推荐几组”时,读取 references/parameter-presets.md,先输出 4–8 组差异明显的参数组合;用户选定后再生成完整提示词和脚本。
参考图提取
- 提取可见主体身份、年龄阶段、外貌或动物识别锚点、造型、位置、比例、朝向、背景和光线。
- 参考图优先于默认值;看不清的非核心细节可标记
系统补全。
- 不用文字模板覆盖图片中已经明确存在的设定。
换装机制改造
用户已有脚本而只想更换变装方式时,保留主体、服装、镜头、时长和布局,只替换触发与相应动作。先读取 references/transition-library.md;需要备选时提供 3–6 个方案。
参数锁定
用户明确给出的参数均为锁定参数,不得擅自替换、弱化或删除。只列本次真正使用的字段:
- 主体路线与基础身份
- 成年年龄感;宠物则写生命阶段
- 国籍 / 族裔外观;宠物则写物种 / 品种
- 外貌或动物识别锚点
- 发型、头饰、耳饰;宠物则写毛色、花纹、项圈
- 初始造型及其余全部造型
- 画幅、布局、背景、光线与主色系
- 视频模式、时长、比例、机位与运镜
- 动作基调、换装机制、完成卡点、声音与结尾动作
- 系统补全项
默认图片布局
卡点模式:五主体拼贴
- 中央:大型主体,约占画面宽度 55%–62%。
- 四个侧边贴图:左上、右上、左下、右下。
- 正好 5 个同一主体版本;中央最大,侧边明显更小。
舞蹈模式:七主体对称拼贴
- 中央:全身主体,约占画面宽度 42%–48%,完整露出头顶和双脚。
- 左侧:左上、左中、左下三个完整主体贴图。
- 右侧:右上、右中、右下三个完整主体贴图。
- 正好 7 个同一主体版本;侧边六个贴图不遮挡中央脸、手臂、腰胯与双脚活动区。
- 六个侧边造型和姿势均不同;左右视觉重量均衡。
通用硬规则:
- 侧边贴图必须沿真实身体或宠物轮廓裁切,不得使用矩形缩略图。
- 每个侧边贴图使用独立白色虚线或用户指定描边;中央主体不描边。
- 同一视频中的所有版本必须是同一主体,只改变服装、配饰和动作姿势。
- 人物必须全身完整;宠物必须完整保留耳、爪和尾巴。
首帧图片提示词
按此顺序编写:
- 画幅、摄影风格与主体路线
- 统一身份和识别锚点
- 明确“正好 5 个”或“正好 7 个”同一主体版本
- 中央主体的位置、构图、姿态与初始造型
- 每个侧边贴图的精确位置、姿态与对应造型
- 轮廓裁切和描边效果
- 背景、光线、镜头、皮肤 / 毛发、发丝与服装面料
- 主色系和画面气质
- 数量、完整肢体、身份一致性等硬限制
- 负面提示词
为视频兼容:姿势不得极端扭曲;头、肩、腰、手臂或宠物四肢结构清晰;服装边缘完整;中央姿势要给后续动作留空间。
默认换装机制
卡点拼贴默认使用“完整主体飞入重合”:
- 激活目标侧边贴图。
- 复制出相同的完整主体轮廓作为飞入副本。
- 原位置目标贴图在飞入启动的同一帧立即消失,原位留空,之后不再出现。
- 飞入副本沿斜线移动到中央并放大,描边始终贴合主体轮廓。
- 副本与中央主体的头、肩、腰和姿态对齐;宠物则对齐头、躯干与四肢支点。
- 对齐瞬间切换服装,飞入副本和描边同时彻底消失。
- 中央只保留一个主体,继续原动作,不产生双影。
舞蹈模式优先使用“侧边贴图激活 + 舞蹈动作峰值换装”:侧边贴图按规定顺序激活并立即从原位消失,在中央人物转身、踏步、手势或身体线条的动作峰值完成服装替换。六次换装后,六个侧边位置全部留空。
若用户指定其它机制,严格使用。详细选择见 references/transition-library.md。
时间轴要求
每一段都必须写明:
- 时间范围与当前造型
- 主体动作和空间位置
- 眼神 / 表情;宠物则写视线、耳朵和尾巴状态
- 舞蹈模式中的舞步、手势与动作峰值
- 被激活的侧边贴图及其原位消失时刻
- 换装运动方向、完成时刻与动作延续方式
- 发丝、袖摆、裙摆、流苏或宠物毛发的自然物理
- 背景音乐节拍;仅在允许时写音效
动作与物理连续性
- 换装前后保持重心、旋转方向、手臂轨迹、头部朝向和视线因果连续。
- 不因换衣重置姿势,不瞬移,不突然改变身体比例。
- 15 秒舞蹈必须是一段连续编舞,每次换装承接上一拍动作。
- 长裙、长袖、披帛、流苏和宠物毛发具有重力、惯性延迟与自然回落。
- 换装瞬间不中断物理状态,不穿模、不粘连、不僵硬漂浮。
强制一致性与负面约束
完整输出必须明确:
- 同一主体身份、脸或动物面部特征、年龄阶段、肤色 / 毛色、发型 / 毛纹与身体比例。
- 只改变服装、配饰和编排姿势,不重做主体。
- 卡点模式默认正好 5 个版本;舞蹈模式正好 7 个版本。
- 已激活的侧边贴图原位置立即清空,之后不保留、不弹回、不复现。
- 中央始终只保留一个主体,不出现双影、残影或身体融合。
- 不出现矩形卡片、额外人物 / 宠物、服装叠穿、错误肢体、多余手指 / 爪、头脚裁切、背景突变或无故运镜。
- 宠物服装不遮挡感官与呼吸,不束缚自然运动。
输出协议
完整生成任务按以下顺序输出:
1)路由判定
- 主体路线:女性 / 男性 / 宠物 / 混合合集
- 视频模式:K 卡点换装 / D 15 秒换装舞蹈
- 判定依据:只写一句
2)参数锁定结果
列出本次使用的身份、造型、布局、时长、卡点、镜头、动作、声音和系统补全项。舞蹈模式必须逐项列出中央造型、左侧 3 套和右侧 3 套,共 7 套。
3)首帧图片提示词
输出一段可直接用于图像模型的完整中文提示词。
4)视频时间轴脚本
按连续时间段覆盖完整 8–10 秒或 15 秒,不得遗漏空档;把每次换装完成时刻精确到 0.1 秒。
5)精简视频提示词
输出一段可直接复制到视频模型的整合提示词,包含主体、镜头、动作、六次或四次换装、贴图消失规则、BGM 与一致性约束。
6)负面提示词
输出逗号分隔的精简负面提示词,覆盖数量错误、身份漂移、贴图残留、双影、肢体错误、服装叠穿、镜头漂移和背景突变。
交付前检查
- 主体路由是否正确,参考图是否覆盖默认值。
- 卡点模式是否为 8–10 秒;舞蹈模式是否严格为 15 秒。
- 舞蹈模式是否正好 7 套、中央 1 套、左右各 3 套。
- 时间轴是否覆盖全时长,完成点是否与造型数量一致。
- 每个被激活贴图是否立即从原位消失且永不复现。
- 人物或宠物是否始终为同一主体,中央是否始终只有一个。
- 音频是否符合:舞蹈默认仅卡点 BGM;卡点模式按用户要求决定是否加音效。