Skip to main content 홈 크리에이터 gaojesse999 ai-scripts martial-arts-director-cy
martial-arts-director-cy 武术指导 skill — 根据人物 / 武术流派 / 场景信息,生成一份 N 宫格武术动作分解海报提示词,并可把每一格拆分为独立的镜头/表达提示词供后续单张图或图生视频使用。借鉴电影武指(袁和平 / 成龙 / 甄子丹 / John Wick / 87eleven)的招式节奏与镜头语言。当用户说"武术指导"、"武术分解海报"、"武打分镜"、"招式分解"、"N宫格武术动作"、"武术套路海报"、"武术编舞海报"时触发。也适用于把现有舞蹈 / 动作分解海报提示词改写成武术版本。
설치로 이동 Skills Marketplace 커뮤니티가 만든 AI 스킬을 발견하고 탐색하세요.
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
직접 명령은 검토 Prompt를 거치지 않습니다. 실행하기 전에 소스를 확인하세요.
npx skills add https://github.com/gaojesse999/ai-scripts --skill martial-arts-director-cy명령은 한 줄로 유지됩니다. 복사하기 전에 가로로 스크롤해 전체 내용을 확인하세요.
로컬 사본을 원하시나요? SkillsMP에서 현재 제공할 수 있는 파일을 다운로드하세요.
Zip 다운로드 다운로드 중... 이 저장소의 다른 Skills renzhi-juexing-deep-focus-active-rest 当用户靠意志力从早学到晚、一放松就失控、分心走神还硬撑、或把「不够苦」当成失败原因时使用。
也包括:把番茄钟当完成配额/道德纪律、休息时段仍刷手机——要纠偏主动休息,不是加番茄数。
短时 100% 专注,精力掉到阈值就主动停;休息不做被动耗注意的刷手机。你没成功,可能是因为太刻苦。
不适用于:内容难度失配(先匹配);注意力障碍的诊断替代。
Triggers: 太刻苦, 分心, 走神, 番茄钟, 主动休息, 学到崩溃, 番茄当纪律, burnout study, pomodoro, can't focus.
renzhi-juexing-drive-not-against 当用户把失败归因于没毅力、靠打卡团/多闹钟/鸡血硬刚天性、或问「怎样更有自制力」时使用。
用「驱动而非对抗」:把理智脑当经理,与本能沟通(后娱乐、降摩擦),不要加码意志力。
不适用于:临床成瘾/创伤/ADHD 的医疗替代;只是问某个习惯的具体技术细节(应先匹配难度或反馈)。
Triggers: 没毅力, 意志力, 自制力不够, 对抗惰性, 戒断失败, no willpower, self-control, grit harder.
renzhi-juexing-eliminate-fuzziness 当用户计划很多却不动、选项一多就去享乐、情绪说不清、或「知道要事第一但下一步仍是一团雾」时使用。
把认知/情绪/行动的模糊写清、拆开,进入「没得选」的单行道。行动力主要靠清晰力,不主要靠自制力。
不适用于:目标已写清仍在寻优收藏(用傻瓜行动);冲动未审视(用元时间);日常琐事过度规划。
Triggers: 写下来, 计划太多, 选择困难, 没得选, 说不清在烦什么, too many options, brain fog, unclear next step.
name martial-arts-director-cy description 武术指导 skill — 根据人物 / 武术流派 / 场景信息,生成一份 N 宫格武术动作分解海报提示词,并可把每一格拆分为独立的镜头/表达提示词供后续单张图或图生视频使用。借鉴电影武指(袁和平 / 成龙 / 甄子丹 / John Wick / 87eleven)的招式节奏与镜头语言。当用户说"武术指导"、"武术分解海报"、"武打分镜"、"招式分解"、"N宫格武术动作"、"武术套路海报"、"武术编舞海报"时触发。也适用于把现有舞蹈 / 动作分解海报提示词改写成武术版本。 allowed-tools Read, Write metadata {"clawdbot":{"emoji":"🥋"}}
武术指导(Martial Arts Director)
把一段武术套路 / 对打设计 / 动作戏拆解成 N 格 keypose,输出一份可直接喂给 AI 绘图工具的「N 宫格武术动作分解海报」完整提示词。可选地,再把每一格拆分为独立的「镜头/表达」提示词,供后续做单张高清图、图生视频或剧照拼图。
核心理念
图片默认 = 高清写实线稿图(v10.0 风格修正,必读 references/line-art-style.md) :本 skill 的图片产出默认渲染为「高清写实线稿图 / line art / 精密线描稿」 ——演武主体与背景一律用「黑色线条 + 干净白底 + 排线 / 影线(hatching、cross-hatching)表达体积明暗」呈现,不上色、不做照片级写实渲染、不做 CG / 二次元 / 插画 ;但线稿必须精确还原 8K IMAX 院线真人实拍质感所需的全部真实人体结构、皮肤微观纹理、布料褶皱、明暗交界结构信息,使后续可由 AI 从线稿还原为电影级写实风格 。这是一条「线稿 → 可还原写实」的工作流:图片是结构精准的写实线稿,视频 / 后续上色环节再把线稿还原成 8K IMAX 院线真人实拍风格。
角色化默认 + 白模为可选规避方案(v9.0,仍适用于"画什么人物"层面) :在线稿这一渲染风格之下,默认仍根据用户需求(年龄 / 性别 / 气质 / 调性 / 武术体系 / 影视参考)适配具象演武者形象 (只是以写实线稿而非彩色照片呈现),让画面有真实人物的张力与情感。白模只在两种场景下使用:(1) 用户明确要做版权规避(如复刻 IP 桥段时避免侵权);(2) 用户明确要做动作 retarget 工作流(动作设计独立于最终角色)。其余情况直接根据用户需求想象适配的具象角色(写实线稿呈现),不要硬套白模。
武术作为艺术(v9.0 核心维度) :武术不只是动作,而是身形 + 节奏 + 力道 + 气韵 + 弧线 + 静动对比 + 环境对话 七维艺术。视频与图片都要承载这些艺术性元素:
身形之美 :身姿的舒展 / 收放 / 倾仰,肢体线条的雕塑感
节奏之美 :呼吸感 / 留白 / 顿挫 / 流动,"动如脱兔静如处子"——长段爆发 + 突然减速 + 加速
力道之美 :劲道贯穿 / 寸劲爆发 / 长劲蓄势 / 重心崩溃,让观众感受到"力"的传导
气韵之美 :眼神 / 表情 / 杀气 / 凝望 / 屏息,传递人物内在状态
弧线之美 :刀光弧线 / 剑光残影 / 拳影轨迹 / 衣袂飘动,构成画面的视觉旋律
静中有动 :定格瞬间饱含张力,对峙凝望胜过千招万式
环境对话 :环境元素与招式互相塑造(具体环境如雨 / 雪 / 竹林 / 灯火等由 agent 根据题材选)武术哲学专业术语锚点(v9.3 新增,让 agent 思考有深层概念支撑) :
武意(Wuyi / martial ideation) :动静交替中的情感溢出——看似无招却有意、看似空白却饱含张力。一拳未发已有杀气,一招收住余韵未散。这是武术超越"打"的境界
武术作为叙事诗 :每一招都在讲故事——人物的伤痛 / 觉悟 / 决断 / 爱恨 / 极限 都通过招式传递。打斗不是为了打,是为了说不能说的话
美学化暴力(aestheticized violence) :把暴力转化为视觉美感与哲学表达——血滴成珠 / 剑光成线 / 衣袂如旗 / 落地溅水。让观众感受到的不是恐惧,而是惊叹与肃穆
道家"无"的形而上空白 :招与招之间的留白、动作与停顿之间的呼吸、对峙凝望中的沉默——这些"无"的瞬间往往比"有"的招式更打动人
使用方式 :写图片 / 视频 prompt 时,agent 思考"这个题材的武意在哪里?这套打斗在讲什么故事?哪个瞬间是美学化暴力的高潮?哪里需要留白?"——而不是只编排招式
动作戏 7 大基础原则(v9.3 新增,电影学通识,clarity 第一) :本 skill 输出的所有动作 / 武术 / 打斗内容必须满足以下 7 原则——这是电影动作戏的基本功,与具体题材 / 武术体系 / AI 模型无关:
Clarity 清晰(最高优先级) :观众必须能跟得上每一招——谁打谁、用什么、命中哪、结果如何。这是动作戏第一原则,所有其他原则都让位于它。如果观众看不懂在打什么,再炫的招都是失败
Geography 场景几何 :人物在空间中的位置始终明确——A 在左 B 在右、A 持刀 B 徒手、距离两步、面朝彼此。每一招后位置变化都要可追踪,不能"瞬移"或失去方位感
Stakes 赌注 :观众要明白"这场打斗输了会怎样"——是生死、是尊严、是爱人、是觉悟。没有赌注的打斗是炫技,有赌注的打斗才让观众屏息
Motivation 动机 :每一招都是角色驱动——A 为什么主攻?B 为什么徒手?她们之前发生了什么?打斗不是为打而打,是人物内在的外化
Choreography 编排 :招式有创意、有逻辑、有节奏——避免"轻微换姿势"、避免抽象招式、避免与人物 / 武术体系不符的设计
Vulnerability 脆弱 :角色要被真实威胁——A 失刀那一刻 B 占优势 / B 倒地时 A 刀逼近 / 双方都在极限。脆弱让紧张感建立
Consequences 后果 :打斗有真实代价——衣袂破损 / 喘息加重 / 汗水雨水滑下 / 重心崩溃 / 关节阻力。每一击都有重量、每一动都有痕迹
武指 + 摄影指导联合产出(v9.1 核心升级) :本 skill 不只设计动作,更设计动作 + 镜头的一体化方案 ——每一招都要配套镜头语言(景别 + 运镜 + 角度 + 速度),让最终视频达到电影级武指作品的水准。
电影镜头语言维度(仅作为方法论工具箱,不预设具体应用) :
景别 :大远景 / 远景 / 全景 / 中景 / 中近景 / 近景 / 大特写
运镜 :固定机位 / 推(push in)/ 拉(pull out)/ 摇(pan)/ 横移跟拍(track)/ 升降(crane)/ 紧贴跟拍(handheld follow)/ 环绕(360 orbit / arc)/ 希区柯克变焦(dolly zoom)/ Whip Pan / 一镜到底(oner)
角度 :平视 / 仰拍(威严力量)/ 俯拍(弱小全局)/ 鸟瞰 / 荷兰角(失衡紧张)
速度 :实时正常速度(默认 80%+)/ 慢镜 / 凝固定格 / 子弹时间 / 快慢交替
这些维度只是工具箱,由 agent 根据用户题材动态选择应用 :什么招式配什么景别 / 什么节点用什么运镜 / 什么瞬间用什么速度——都不预设。
影视参考由 agent 动态思考与搜索(v9.2 反硬编码原则) :本 skill 不预先列出"必须参考的电影清单" ——agent(Claude Code / Codex 等)在执行 skill 时,必须根据用户输入的具体题材 / 调性 / 武术体系 / 人物气质,自主分析并选择 1-3 部最契合的影视参考作品 ,然后把这些作品的镜头美学 / 节奏感 / 视觉风格融入图片与视频 prompt。具体执行:
如果 agent 对用户题材有充分训练记忆 → 直接选用最契合的影视参考
如果用户题材冷门、新颖、agent 不确定哪部最契合 → 主动调用 WebSearch / WebFetch 等工具 搜索"XX 题材武术电影代表作"、"XX 风格打斗经典镜头美学"、"XX 武术体系最佳影视范例"等关键词,获取最新参考资料
生成最终 prompt 中可以引用具体电影名 (这是模型理解风格的最大杠杆)——但这些电影名是 agent 当下根据题材动态选定的,不是 skill 模板里预先硬编码的清单
同样原则适用于"武术体系动作设计"、"环境元素"、"调性参照"——agent 都应根据用户输入动态思考,必要时搜索补充,不套预设模板
同一人物锁定 :所有格子是同一个演武者、同一套服装、同一种调性,靠人物锚定卡防止 AI 跨格漂移
每招视觉差异化 :朝向、重心、肢体张开度、攻击部位都明显不同,避免"轻微换姿势"
可拆分 :主提示词出一张多宫格海报;每格还能单独拆出来做高清图或视频起始帧
动态生成,反硬编码 :骨架库 / 模板 / 强化关键词都是「工具箱」,不是「答案」。每次生成必须根据用户输入的人物、调性、场景、影视参考做实质性定制;同一题材两次调用,招式名 / 动作要点 / 姿态分配 / 景别选择都应有可观察的差异(至少 30% 不同),让 AI 出图也能呈现不同的演武编排
标准交付 = 1 份图片 prompt + 1 份视频 prompt(v9.6 根本性修正) :本 skill 最终产出两份提示词 :
多宫格分镜 prompt (Step 3)→ 4×4 / 16 宫格分镜海报,既是用户的武指工作单(整体动作字典),也是直接喂给视频模型的参考图 ——用户拿到后无需额外加工
视频 prompt (Step 4)→ 用户把多宫格海报 + 这段视频 prompt 一起喂给视频模型,生成 15 秒连贯打斗视频,视频会按图中 16 格顺序连贯演完所有动作
关键架构(解决"视频与图对不上"的根本性问题) :视频模型默认会把多宫格图当作单帧拼贴而困惑,所以视频 prompt 必须前置一段「参考图阅读协议」 ,明确告诉视频模型:
这张图是 4×4 = 16 格分镜表 (不是多场景拼贴 / 不是单一画面)
格序 = 时间序 :从左上第 1 格 → 按行优先(左→右、上→下) → 右下第 16 格,每一格是一个连续动作时间点
15 秒视频 = 16 格动作的完整连贯演绎 ,不漏任何一格、不增任何图外动作
排除 UI 注释层 :图中编号 / 中文标题 / 要点 / 箭头 / 轨迹线 / 格子边框 / 文字标注全是分镜表的注释(武指工作单标记),不要渲染到视频,视频是单一连贯电影画面无格子分隔
角色与场景一致性锚点 :每格的人物外貌 / 服装 / 武器 / 场景必须在视频全程保持一致(图就是这些信息的视觉锚点)
不需要再生成额外的"首帧图" ——多宫格图本身就是足够的视觉锚点 + 完整动作字典,前提是视频 prompt 中正确教会模型"如何读图"
最终视频效果优先(北极星指标) :本 skill 不是出"好看的图",也不是出"通顺的 prompt",而是出一段大片级打斗视频 。每个写作决策都要回答:"这条对最终视频的视觉冲击力 / 动作连贯性 / 打斗故事感 有什么贡献?"——没贡献就删,有反作用就改。三个核心要求:
动作连贯性 :图作为视频起始帧必须能被自然驱动延展,keypose 是"运动中的瞬间"(剑刚劈到一半 / 拳头正向上身要害推进中 / 脚刚离地)而非"已完成的死姿态"
大片打斗 essence :必须包含冲击瞬间 / 节奏对比 / 空间立体调度 / 环境破坏 / 凝视停顿 / 死亡威胁感 等大片武指语法
戏剧弧线 :起势凝神 → 试探 → 爆发 → 反转 → 高潮 → 收势,是讲一个打斗故事,不是堆砌招式
图视频零漂移(v8.3 强化) :图片 prompt 与视频 prompt 必须镜头一一对应、无遗漏、无幻觉、无 UI 串扰 :
镜头无丢失 :图里 N 格 keypose 必须全部出现在视频里 ——可以"完整演 / 一笔带过 / 凝视聚焦 / 浓缩并击",但不能跳过 。Step 4 视频 prompt 必须显式输出「镜头覆盖清单」,让用户能逐格核对
UI 不串扰 :图里的编号 / 中文标题 / 动作方向箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 中文要点说明 是 pre-vis 海报的工作单标记 ,不是画面内容 ——视频生成时这些 UI 元素严禁 出现,必须在视频 prompt 中显式排除
环境与人物连贯 :视频中的人物服装 / 兵器形态 / 环境光感 / 调性必须与图严格一致,避免"图是白模 → 视频变成真人""图是黄昏 → 视频变成正午"等漂移
工作流(5 步,按顺序执行 + 双模式分流)
Step 1|信息收集(前期准备) 模式 触发条件 处理路径 A. 创作模式 (默认)用户只给方向(如"做一个仙逆风的"、"做一个咏春的"、"女杀手双刀") 按下方 Step 1 表格走完整 9 字段 B. 桥段还原模式 用户指定具体作品桥段(如"还原叶问 vs 十个武道家"、"复刻仙逆 S1 第 X 集王林对战苏铭"、"重现《老男孩》走廊那场"),含「还原 / 复刻 / 重现 / 像 X 里的 Y 那样」等指向具体片段的词 + 具体作品 / 章节 / 场景 跳到本 Step 末尾的「桥段还原子流程」
默认走 A 创作模式。 如不确定,主动问用户:"你是想自由创作一套(A),还是想还原某个具体桥段(B)?"
向用户列出下表,让用户用一段话回复即可(不要逐项追问)。任何字段缺失主动补问,已给出就跳过。
字段 说明 示例 呈现风格 (必填,默认高清写实线稿图 line art)图片的视觉表达方式 高清写实线稿图 / line art(默认,黑线白底、排线表达体积、可还原写实) / 3D 白模 / 线框模型 / 木质人偶 / 黑色剪影 / 角色化彩色最终画面 (仅当用户明确要求上色时)体型与气质 性别气质、身高比例、体格倾向(线稿仍精确刻画真实人体结构) 修长精瘦男性肩宽腿长 / 中等身材女性舞者身段 / 矮壮敦实大叔型 角色化外貌 (线稿默认也填)演武者具象外貌(线稿精确还原其真实人体结构);仅纯白模规避模式可跳过 中国女孩长相、约 22 岁、英气、五官立体 角色参考图 + 挂载名 (可选,影响命名)是否随附演武者参考图及其挂载名 / 引用名。有参考图 → 后续所有 prompt 直接引用「参考图挂载名」(如 @女主,不是参考图人物的真实角色名),不写泛化外貌;无参考图 → 用泛化视觉描述、不出现名字 (见 Step 3 规范 13b) 提供参考图、挂载名 @女主 / 自有角色照标 @角色1 / 无 武术体系 传统武术 / 现代格斗 / 兵器 / 影视武指风格 咏春 / 八极 / MMA / 双刀 / John Wick gun-fu 风格调性 写实硬派 / 飘逸写意 / 暴力美学 / 慢镜美学 / 长镜头压迫 暴力美学 + 慢镜头 装备简化表示 必要装备的极简表示(白模模式下用极简符号;角色化模式下用完整服装) 白模:头束简洁布带 / 腰系窄腰带 / 脚踝绑带 / 持械护手 等极简符号;角色化:黑色短款机能马甲 + 紧身长裤 + 战术绑腿 + 皮革护腕 等完整服装 场景 地点 / 背景调性 / 光感 暗色舞台灰 / 竹林晨雾 / 雨夜霓虹街 / 中性灰背景 宫格规格 总格数 + 排布 16 = 4×4(默认)/ 9 = 3×3 / 12 = 3×4 / 4 = 2×2 是否带兵器 影响招式骨架 徒手 / 单刀 / 双截棍 / 长棍 / 软鞭 / 双枪 影视参考 (可选)喜欢的武指风格 袁和平《卧虎藏龙》/ 甄子丹《叶问》/ John Wick / 杀死比尔 / 老男孩长镜头
输出物 :一份「人物锚定卡」表格,作为后续所有提示词的统一参数源。
如果用户只给了主题(如"做一个咏春的"),先按表格补全:默认 16 格、徒手、暗色舞台灰背景、暴力美学+电影武指调性,然后让用户对默认值做增删。
桥段还原子流程(B 模式专用,替代 A 模式的 Step 1 表格) 进入还原模式后,严禁 AI 凭印象自由发挥 ——AI 对作品的"训练记忆"可能不准、过时、张冠李戴,必须以用户描述为准。
字段 说明 作品名 + 桥段定位 如:仙逆 S1 第 12 集王林初战苏铭 / 叶问 1 武馆十人战 / 杀死比尔 1 青叶屋大战 / 突袭 2 走廊群斗 桥段长度 / 总招式数 用户希望拆成几格(默认 16) 参与角色逐一描述 每位角色:外貌、服装、武器、阵营 招式按时间顺序 每一招:谁做了什么动作 / 对谁 / 用什么武器 / 结果(命中 / 闪过 / 反击) 关键镜头切换 哪几招用了特写 / 慢镜 / 长镜 / 跳切 环境与氛围 场地、光线、天气、配乐风格
让用户详细描述 桥段——不要催促、不要让用户简化
如果 AI 对该桥段有印象(训练数据中存在),主动告知 :"我对这个桥段的印象是 XYZ,对吗?你想强调或修改哪些细节?"——但必须等用户确认或修正 ,不要直接当答案
如果 AI 对该桥段无印象,直接告知用户 :"我对这个桥段没有可靠记忆,请你尽量详细描述每一招,我严格按你的描述拆分镜。"
用户描述 + 确认后的细节,转换成标准的「人物锚定卡」+「N 招招式列表」
B 模式不调用 references/choreography-beats.md 的骨架库 ——招式列表完全来自用户描述,骨架库是泛化模板,不能用于精准复刻
起势 / 收势仪式感、姿态配额、4 类强化关键词、虚化对手剪影等规则仍然适用 ——除非用户描述明确说"该桥段没有起势 / 直接打"
完成后,回到主流程的 Step 2(招式编排)继续,但跳过骨架库,直接用用户描述生成招式列表。
Step 2|招式编排(武指段子设计) 读取 references/martial-arts-systems.md 找到对应武术体系的招式词库,再读取 references/choreography-beats.md 选用与「宫格规格 × 武术体系 × 是否带兵器」匹配的段子骨架。
每招视觉差异明显 :朝向(正/侧/背)、重心(高桩/中桩/低桩/腾空)、肢体张开度、主要发力部位都不能重复
段间逻辑闭环 :起势 → 进攻段 → 防御/反击段 → 收势,符合套路或对打的真实节奏
可视化优先 :选定格清晰、画面有张力的招式,避免"快速过渡动作"(如步法切换、虚招)单独占格
风格匹配 :硬派选短促爆发的招式(寸拳、肘击、膝撞),写意选舒展飘逸的招式(云手、剑花、回旋踢)
起势 / 收势仪式感 :第 1 格(起势)和第 N 格(收势)严禁默认成"双手负后正面站姿"——必须从下方仪式感动作池中根据角色调性动态选择,且起势与收势两者必须明显不同(如一个面对镜头一个背身、一个高桩一个低桩、或不同的手部状态)。
仪式感动作池 :抱拳礼 / 持剑诀(食中二指竖立胸前)/ 单膝半跪 / 微微低头蓄势 / 立掌当胸 / 拈花指 / 双手合十 / 长身抱兵(持械礼)/ 撑剑而立 / 跨步亮势 / 回身扣手 / 双手负剑微低头 / 倚壁负手 / 横兵于膝
选择依据 :人物调性(阴鸷→低头蓄势 / 庄严→抱拳礼 / 飘逸→拈花指 / 杀气→撑剑跨步 / 颓废→倚壁负手)+ 兵器(无兵器→抱拳礼或合十;剑→持剑诀或撑剑而立;棍→长身抱兵;枪→跨步亮势)
骨架是「招式词典」不是「答案模板」,必须基于用户输入做实质性定制:
根据人物性格 (阴鸷 / 豪迈 / 优雅 / 野性 / 颓废 / 冷静 等)调整招式风格
根据场景 (雪地 / 屋顶 / 走廊 / 竹林 / 道场 / 雨夜 / 沙漠 等)调整动作幅度与方向
根据影视参考 (袁和平 / 甄子丹 / 87eleven / 杀死比尔 等)调整节奏与镜头偏好
根据用户兴趣点 ("我喜欢飞剑回旋""不要雷术""加更多近身缠斗"等)增删
每次生成至少替换、改写或重组 1/3 的骨架招式 ,不要原样套用
同一题材连续两次调用,结果必须有明显不同(招式名 / 姿态分配 / 要点描述)
姿态配额(强制) :N 招的姿态分布必须满足以下下限,否则视觉差异不够,AI 出图会"每格都在站桩":
至少 ⌈N/5⌉ 招低桩 (半蹲 / 沉马 / 跪步 / 仆步)
至少 ⌈N/8⌉ 招腾空或高位 (跳跃 / 仰头 / 双手举高)
至少 ⌈N/5⌉ 招转身或背身 (背对镜头 / 侧身 90°)
至少 ⌈N/8⌉ 招近景特写 (手部 / 兵器局部 / 眼神局部,画面只露上半身或局部)
其余可自由站姿
以 16 格为例:≥3 低桩 / ≥2 腾空高位 / ≥3 转身侧身 / ≥2 近景特写 / ≤6 自由站姿。
输出物 :一份「N 招招式列表」,每招一行,在要点后用方括号标注姿态标签:
01|起势抱拳礼 | 双手抱拳胸前、目视正前、中桩 [自由站姿]
02|进步直拳 | 右脚上步、右拳水平直击、重心前倾 [低桩]
05|转身扫腿 | 转身 180°、右腿水平鞭击、双臂展开 [转身]
07|腾空飞踢 | 双脚离地、右腿前蹬、长袍狂舞 [腾空]
11|符箓特写 | 抓符箓的手指清晰、符光绽放 [近景特写]
...
16|定格亮相 | 单膝半跪、左拳收腰、右掌前推 [低桩]
把这份列表先给用户看一眼(不必等确认),再进 Step 3。
Step 3|组装多宫格海报提示词(核心产出) 读取 references/poster-template.md 与 references/line-art-style.md,把 Step 1 的人物锚定卡 + Step 2 的招式列表填入主模板,并把线稿风格脊柱(线稿技术规范 / 写实人体与材质线条逻辑 / 画面排除项)按语义融进风格 / 服装 / 背景 / 整体效果各处。
线稿风格强制嵌入(v10.0 必出) :图片默认渲染为「高清写实线稿图 / line art」。提示词中线稿核心关键词必须出现:黑色线条 + 干净白底、线条流畅肯定粗细有节奏、外轮廓与结构转折线准确、体积与明暗用排线 / 影线(hatching、cross-hatching)表达、不上色不做照片级渲染、保持纯线稿质感、可由 AI 从线稿还原为 8K IMAX 院线真人实拍写实风格。同时声明排除项:不要卡通 / 动漫 / 二次元线稿 / 插画上色 / 游戏 CG / 色彩填充 / 照片级上色 / 塑料材质 / 水印 / Logo。唯一允许的非线稿元素是多宫格功能性工作单注释 (编号 / 招式标题 / 要点 / 箭头 / 重心轨迹线 / 格子边框)。线稿虽不上色,但要精确刻画真实人体比例、肌肉骨骼、皮肤微观纹理(留白表高光)、布料褶皱物理、空间透视(远疏近密)等全部写实结构信息。
不留占位符 :模板里所有 {{xxx}} 必须替换为具体描述,不能留字面
招式全列 :N 招按顺序全部写出,名字精炼但具体("转身扫腿"而非"扫腿")
调性对齐 :调性定语必须与 Step 1 的"风格调性"严格一致
人物三锚点 :人物特征至少包含 3 个锚点(如"短马尾、英气剑眉、修长比例"),降低跨格漂移
服装三要素 :材质 + 颜色 + 款式都要写出
字数控制 :中文字符总长度 700-1050 字之间——过短信息量不够,过长 AI 容易丢点
兵器贯穿 (如有):兵器材质 + 颜色 + 长度在主提示词中明确,并在动作连贯句中至少出现 2 次
纯文字输出 :不加 markdown、编号符号、引号、参数名等装饰
动态招式强化 :动态招式(瞬移 / 突进 / 雷光下劈 / 旋身鞭腿 / 腾空踢 等)的招式名后或要点说明中,必须含动作模糊 / 残影 / 速度线 / 衣袂横拖 等词,否则 AI 出图会画成静态站桩
法术/特效招式标注方向 :法术或灵气类招式(灵气压制 / 引雷术 / 灵气爆体 / 符箓爆发 等)必须标注灵气方向 (前推 / 上冲 / 下劈 / 爆散 / 环绕),否则 AI 默认全部画成"环绕特效"
手部精细动作标注清晰度 :手部动作密集的招式(手印 / 抓符 / 指诀 / 拈花 / 捏诀)必须在要点中加"清晰可见的手指姿势 / 五指分明"
对手参照系(强约束) :单人海报里涉及"对手"语义的招式(封喉 / 反刺 / 定身 / 锁喉 / 控制 / 肘击 / 摔投),必须同时标注:(a) 目标高度参照 (颈部 / 胸口 / 腹部 / 头顶 / 视线斜上);(b) 虚化对手剪影 (半透明黑影 / 残影 / 对手轮廓 / 虚影站立 / 跪倒虚影),让 AI 把对手画进画面而不是靠观者脑补
角色描述模块化(v8.3 新增) :把「演武者外貌 / 服装」描述写成一段自成一段、清晰可识别的角色块 (开头用「演武者为同一位 ...」结尾用「全程保持同一人物」),让用户后续要替换为自己上传的人物图时,只需替换这一块 即可保留所有动作 / 镜头 / 场景 / 调性设计。禁止 把人物外貌特征零散散布在多招要点里——会让"角色替换"变得非常麻烦
13b. 角色命名规则:有参考图用「参考图挂载名」,无参考图用泛化描述(v10.2 修正) :根据用户是否提供「角色参考图」分流——
已提供角色参考图 :角色块直接引用该参考图的挂载名 / 引用名 (即用户给这张上传参考图起的标签 / 句柄,如 @女主、@角色1、参考图人物),写成「演武者为同一位{参考图挂载名},全程保持同一人物」。这里用的是"参考图的名字",不是参考图里人物的真实角色名 / IP 名 ——目的是让 i2i 工具按挂载的那张参考图来画,而不是去推断或暴露角色真实身份。也不要 再写「一位古典神话风格的女战士」等泛化外貌堆砌(参考图已锁定全部外观);可在挂载名后补 1-2 个动作 / 兵器 / 气质锚点。
未提供角色参考图 :按常规用泛化视觉描述(年龄 + 性别 + 气质 + 武术身份 + 服装三要素 + 三个面部 / 体型锚点),不出现任何名字。
适用范围 :Step 3 图片角色块、Step 4 视频「人物开场」、单格高清图角色描述全部遵循同一分流。
与版权脱敏的关系 :因为引用的是"参考图挂载名"而非真实角色名 / IP 名,本身不触发版权脱敏问题;用户未提供参考图、走 IP 桥段还原或通用绘图时,仍按版权脱敏规则用视觉特征替代专名(Step 4 视频 prompt 的脱敏底线不变)。若用户给参考图起的挂载名恰好是某 IP 真实角色名,提醒用户改用中性挂载名(如 @女主)再喂工具。
每格 keypose 必须是"运动中的瞬间"(v8.7 强化,服务实时视频起始帧) :每格的姿态描述必须是爆发瞬间 / 接触瞬间 / 动作中段 (如「短刀正向上身要害推进中」「拳头正向胸口推进中」「脚刚离地腾空起跳」「衣袂横拖出残影」),禁止 写"已完成的最终定格姿态"(如「已经完成劈砍后收刀的姿态」)。理由 :v8.7 视频是 15 秒实时速度,图作为起始帧若是死姿态,视频开场会"重新启动"造成节奏断裂;若是运动中瞬间,模型会自然延续动作流
图片与视频是配套整体,图片不预分段(v8.7 修正) :图片就是一份完整连贯的 N 格动作分解,按用户题材 / 武术体系 / 风格 / 兵器动态生成;视频参考整张图作为视觉锚点 + 动作字典生成 15 秒对应视频。严禁在图片层硬编码"A 段 / B 段 / C 段"视觉分组、戏剧弧线进度条、金色边框 / 红色描边 / 段落标题等装饰 ——这违反反硬编码原则、过度设计、且让海报失去 pre-vis 工作单的简洁。段落选择是视频 prompt 阶段的责任 (视频从 N 格里精简到 8-10 招),不是图片层要预先分组
输出物 :一段完整可直接复制的中文提示词。输出后告诉用户:"这段直接复制到主流 AI 绘图工具,输出为高清写实线稿图(黑线白底、排线表达体积、可还原写实),多宫格海报建议画面比例 1:1 或 4:3、分辨率尽量 ≥1024×1024(若要单格 / 单人竖屏分镜可用 9:21),输出目标 4K 以上以保留可还原写实的全部结构信息。这张多宫格线稿海报既是你的武指工作单(整体动作字典),也是直接喂给视频模型的参考图——不需要再生成首帧图 。视频模型会根据 Step 4 视频 prompt 中的「参考图阅读协议 + 线稿还原声明」把线稿结构还原为电影级写实风格、按 16 格顺序连贯演完所有动作。如果之后想用自己上传的人物图或彩色角色替换,只需替换提示词中『演武者为同一位 ... 全程保持同一人物』这一段。"
Step 4|一整段图生视频 prompt(标准必出,与 Step 3 配套) Step 3 已输出图片 prompt(多宫格海报)。要做成最终的动态打斗视频 ,必须再输出一份一整段连贯的视频 prompt ——不是 N 段碎片,是从起势写到收势的完整电影叙事段落。
Step 3 图片 prompt → 1 张多宫格海报(既是视觉规划,也是视频参考图)
Step 4 一整段视频 prompt → 用户把 Step 3 生成的图作为视觉参考
(first frame 或 style reference)
+ 这段视频 prompt
→ 喂给视频模型(即梦 / Kling / Seedance / Sora / Veo)
→ 一段 5-15 秒连贯的完整打斗视频
视频 prompt 是"一整段连贯描述",不是"N 段碎片" ——它描述完整的动态演变,让视频模型一次性出一段连贯片段
必须与图片 prompt 配套 ——人物 / 服装 / 兵器 / 场景与 Step 3 严格一致;只给图不给视频 prompt(用户没法生成视频)/ 只给视频 prompt 不给图(视频模型缺视觉锚点)都不算交付完整
15 秒标准时长 + 8-10 招完整戏剧弧线(v8.7 产品规格) ——经过多版迭代,本 skill 把视频时长固定为 15 秒 作为标准产品规格,不再让用户每次纠结 5/10/15 秒。15 秒是大片打斗的黄金时长:
能装 8-10 招实时连招 (每招约 1.5-2 秒,符合院线大片真实搏击节奏)
能展开完整戏剧弧线 (起势凝神 → 试探 / 第一次接触 → 爆发主攻 → 反转 / 转守为攻 → 高潮决招 → 收势凝望)
能容纳 1 处决定性瞬间凝固定格 (约占 1 秒,作为屏息电影海报级一帧)
15 秒招式编排模板 (六阶段相对时长锚点,写在视频 prompt 中作为节奏指引):
起势凝神:约占 1/10 时长(1 招)
试探 / 第一次接触:约占 1/6 时长(1-2 招)
爆发主攻:约占 1/4 时长(2-3 招)
反转 / 转守为攻:约占 1/8 时长(1 招)
高潮决招(含凝固定格):约占 1/4 时长(1-2 招)
收势凝望:约占 1/8 时长(1 招)
合计 8-10 招 / 完整 15 秒
图片 N 格是"完整动作字典",视频从中选 8-10 招最具视觉张力的核心段落 (默认选含戏剧反转的高潮前后段)
如果 N 格里某些段落用户特别想要 :分多段拍 15 秒视频后期剪辑拼接成 30-45 秒完整对打(如「起势对峙段 15s → 试探接触段 15s → 高潮决战段 15s」)
工具兼容性 :如果用户工具不支持 15 秒只支持 10 秒,把试探段或反转段压缩 / 删除一招,戏剧弧线骨架保留即可
保留的镜头覆盖清单 (v8.3 仍然必出,但语义改为"本视频选演哪几招、其余跳过"):
字数与质量平衡(v9.8 修正 — 分镜清单为主,其他极简) :
字数压缩不能以牺牲表达质量为代价。核心原则是「信息密度最大化」+ 「禁止重复信息」 。
v9.8 关键重构 :自从 v9.7 引入「分镜执行清单」后,分镜清单本身已经包含所有 16 格的动作 / 招式 / 镜头 / 时序信息——所以其他段落必须极度精简,禁止重复分镜清单中已有的信息 。
[参考图阅读协议] 约 80-100 字(5 条核心规则)
[节奏定调] 约 30-50 字(实时 + 反例排除)
[忠于参考图 + 一致性] 约 50-80 字(外观锁定 + 动态元素白名单)
[分镜执行清单] 约 350-450 字(主体,16 格逐行)
[自检指令] 约 20-30 字(1 句话)
合计目标 600-800 字
禁止出现的冗余段落 (之前版本残留,v9.8 必须删除或合并):
❌ [场景与人物]:场景与人物信息已融入分镜清单第 1 格 + [忠于参考图] 段
❌ [实时连招叙事]:与分镜清单完全重复,禁止保留
❌ [镜头与速度]:每格的镜头已标在分镜清单,全局速度已在 [节奏定调]
❌ [Continuity]:核心 1-2 句融入 [忠于参考图],不需要单独段落
❌ [武术艺术]:核心 cue(武意 / 决定性瞬间)已在分镜清单的关键格描述中体现
低于 600 字:分镜清单可能描述太薄
600-800 字:分镜清单充分 + 全局约束精简的最佳区间
高于 800 字:基本就是有重复段落了,必须删冗余
必须保留的关键 cue(少了就质量崩塌) :
节奏定调 :「实时速度」+「反例排除(不要慢镜 / 不要教学)」+「凝固定格仅 1 处」
风格锚点 :影视参考片单(如《疾速追杀》《一代宗师》《突袭》),这是模型理解风格的最大杠杆
UI 排除 :编号 / 文字 / 箭头 / 轨迹线 / 格子边框
忠于参考图 :动态元素白名单 + 不加额外人物 / 武器
动作三要素(每招必须含) :人物 + 具体动作 + 对手反应("A 推刀 B 闪过"而不是"A 进攻")
决定性瞬间标记 :明示哪一刻是凝固定格屏息一帧
物理重量感关键词 :关节阻力 / 衣袂鼓荡 / 落地水花 / 残影等具体词(任选 2-3 个)
可以压缩的(不影响质量) :
重复表达(同一原则不在多段重复说)
过度修饰副词("缓缓"、"渐渐"、"慢慢地"等)
独立解释段(如"动作连贯性原则解释"独立成段——其实融入叙事动词「余势带 / 借势 / 反弹起」就够了)
冗长场景铺陈(开场 1-2 句即可)
写作技巧 :
用动词代替形容词("推刀"代替"正在缓缓推进的刀光瞬间")
关键指令前置(节奏 / UI 排除 / 忠于图 写最前 3 段)
动作叙事用顿号 + 短句堆叠(每个短句 = 一招),节奏感更强
列名词清单代替造句(如"动态元素仅限:衣袂残影、雨水飞溅、霓虹反光、速度线")
图片 prompt 目标长度仍为 700-1050 中文字符 (绘图模型容量大、需要更细致角色与场景锚点)。
视频 prompt 结构方法论(v9.3 新增,行业通用模板,agent 根据题材自主选用) :
写视频 prompt 时不要凭感觉散写——以下三种结构都是动作 / 武术 / 打斗题材的成熟方法论,agent 选一种应用即可(也可以混合):
A. 五段式结构(适合大部分动作戏 / 武术 / 打斗)
[Cinematography 镜头] + [Subject 主体] + [Action 动作] + [Context 环境] + [Style 风格氛围]
每段一两句,整体 250-450 字。优势:清晰、易理解、对模型友好。适合:单镜头连贯打斗 / 短段对决。
B. 八点 Shot Grammar(适合精细控制 / 长段动作戏)
每个镜头按 8 个维度展开:
Subject(谁)
Emotion(情绪状态:杀气 / 凝视 / 决绝 / 惊愕)
Optics(景别 + 镜头类型:中景 / 近景特写 / 浅景深 / 广角)
Motion(人物动作 + 摄影机运动:A 推刀 + 横移跟拍)
Lighting(光线:冷光 / 逆光 / 顶光勾边)
Style(风格:写实硬派 / 写意飘逸 / 暴力美学)
Audio(声音节奏感:金属摩擦 / 衣袂破空 / 重击闷响——写在文本里给模型理解节奏)
Continuity(连续性锚点:与前一镜头如何衔接)
适合:高潮决战、复杂多镜头、需要专业级精度的场景。
[00:00-00:03] 远景仰拍,A 持刀立于雨中,B 徒手立于对面,眼神锁定
[00:03-00:06] 中景横移跟拍,A 进步斜斩,B 上身侧倾闪过,雨珠飞溅
[00:06-00:09] 360 度环绕近景,B 下潜抓 A 持刀腕拧转,关节阻力
[00:09-00:12] Whip pan 转镜,B 翻腕反夺短刀,A 失重踉跄
[00:12-00:15] 低角度推近,两人相隔三步喘息凝望,凝固定格
优势:精确控制节奏 / 不会丢镜头 / 给模型清晰的时间锚点。适合:完整戏剧弧线 / 多镜头连贯爆发。
无论选哪种结构,叙事中用「节拍」标记每招 ——这是 Sora 类模型推荐的动作戏写法:
节拍 1:A 起势,眼神锁定 → 建立赌注
节拍 2:A 进步斜斩,B 闪过 → 第一次接触
节拍 3:B 下潜抱腰,A 提膝阻挡 → 缠斗启动
...
每个节拍 = 一个清晰的动作单元 + 对手反应 + 时间锚点。比纯叙事段落更精确、模型更容易理解节奏。
Continuity 连续性 4 维(v9.3 新增,每段 prompt 都要保证) :
动作戏最怕"动作不连贯 / 角色漂移 / 道具消失"。明确以下 4 维 continuity 锚点:
角色 continuity :外貌 / 服装 / 武器形态 / 体型 / 气质 全程一致,每个镜头都重申关键锚点
空间 continuity :场景方位 / 光线方向 / 环境元素 / 距离关系 一致——A 在左 B 在右,不能突然换位
道具 continuity :武器使用 / 道具状态合理传递——刀被夺走后不能凭空回到原主、衣袂破损后不能复原
时间 continuity :天气 / 光照 / 雨雪 / 衣饰湿润度 / 汗水累积 合理推进——开场干爽到收尾湿透
视频 prompt 输出格式(v8.4 严格分两部分 + 相对节奏 + 忠于参考图) :
正文与使用建议分离 :视频 prompt 正文(用户复制喂给视频模型的)与使用建议(用户看的工具配置说明)必须明确分离。「建议时长」「运动幅度档位」「宽高比」「帧率」这些是工具的 UI 参数 / 用户配置层信息,不能塞进视频 prompt 正文 ——模型读到只会困惑或忽略,反而稀释正文有效信息密度。
节奏用相对描述,不写绝对秒数(v8.4 新增) :视频生成模型的总时长是用户在工具 UI 里选的参数 (5/10/15 秒),prompt 里写「1.5 秒完整演」「0.6 秒凝固定格」会与工具实际时长冲突——5 秒视频总长里塞不下"1.5 秒 × 16 招"。改用相对节奏词 让模型按用户选定的总时长自动分配比例:
「较长定格 / 短促一击 / 凝固瞬间 / 一笔带过 / 浓缩并击」(强度档)
「起势段较长 / 中段紧凑 / 高潮拉长定格 / 收势缓慢」(曲线档)
「关键招与过渡招的时间比约为 3:1」(相对比例)
忠于参考图,禁止凭空添加(v8.4 新增) :视频生成模型经常在 i2v 时"自由发挥",添加图里没有的人物、武器、特效、桌椅家具、围观角色、未指定的烟雾血迹等。视频 prompt 必须显式声明「忠于参考图原则」 :人物数量 / 武器形态 / 场景元素 / 调性 / 服装细节都以参考图为准,不增不减 ;动态元素(衣袂残影、粒子)只能是 prompt 中明确列出的种类。
输出时按下面两个独立块输出,标题清晰区分。Prompt 正文目标长度 约 450-750 中文字符 。
═══ 视频 prompt 正文(直接复制此块喂给视频模型)═══
[参考图阅读协议(v9.6 强制必出,写在视频 prompt 最前段)]:参考图是一份 4×4 = 16 格分镜表(武指工作单),**不是多场景拼贴、不是单一画面**。请按以下方式读图并生成视频:
- **格序 = 时间序**:从左上第 1 格开始,按行优先顺序(先从左到右、然后下一行、依次到右下第 16 格),每一格代表一个连续动作时间点
- **15 秒视频 = 16 格动作的完整连贯演绎**:按 1→2→3→...→16 顺序演完所有 16 格的动作,构成单一连贯电影画面,**不要漏任何一格、不要合并任何两格、不要添加图外动作**
- **排除 UI 注释层**:图中编号 / 中文招式标题 / 中文要点说明 / 动作箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 任何文字标注 全部是分镜表的注释(武指工作单标记),**不要渲染到视频中**。视频是单一连贯电影画面,**不存在格子分隔**
- **角色与场景一致性锚点**:每一格中的人物外貌、服装、武器、场景元素必须在视频全程保持一致(图就是这些信息的视觉锚点,agent 直接以图为准)
- **线稿还原声明(v10.0 强制必出)**:参考图是高清写实线稿(黑线白底、排线表达体积),其中已编码 8K IMAX 院线真人实拍所需的全部真实结构信息。请把线稿结构**还原渲染为电影级写实真人画面**(真实皮肤质感、布料材质、电影级布光、自然焦外虚化)再让其动起来——视频不是线稿动画,而是按线稿结构还原出的写实影像;线稿只是结构蓝图,不要在视频中保留线条 / 排线 / 白底等线稿外观。
- **每格转下一格用动作惯性自然衔接**:不机械跳剪,前一格的发力余势带出下一格的起势,像水流不像 PPT 翻页
[分镜执行清单(v9.7 强制必出,时间戳逐格清单 — 杜绝丢镜头的核心机制)]:紧跟「参考图阅读协议」之后,必须用**时间戳分镜清单**逐格独立列出 16 格的执行指令。这是确保视频模型不丢镜头的最强约束——比纯自然语言叙事段落更不容易被模型自动取舍。格式:
[00:00-00:01] 第 01 格|招式名|动作要点(精炼一句)|镜头标签
[00:01-00:02] 第 02 格|招式名|动作要点|镜头标签
[00:02-00:03] 第 03 格|招式名|动作要点|镜头标签
...
[00:14-00:15] 第 16 格|招式名|动作要点|镜头标签
**时长分配原则(agent 根据题材戏剧弧线灵活分配)**:
- 总时长 15 秒精分到 16 格,**每格平均约 0.9 秒**,但不必完全均分
- **必演核心格分配更长**(约 1.2-1.5 秒):第 1 格起势 / 戏剧反转格 / 决定性瞬间格 / 第 16 格收势——这四格用「凝固定格 + 慢推」拉长
- **过渡 / 试探格压缩**(约 0.5-0.8 秒):用快剪 / 残影 / 一笔带过
- **关键约束**:所有 16 格的时长之和必须 = 15 秒,**不允许任何一格被分配 0 秒(即跳过)**
**自检要求(写在分镜执行清单末尾)**:「在生成视频前,请确认:清单中 16 格是否全部出现在视频中?每格是否有至少 0.3 秒以上的画面呈现?如有任何一格被跳过,请重新规划时间分配确保全覆盖。」
[忠于参考图原则]:本视频严格以参考图为视觉锚点。人物数量、武器形态、服装细节、场景元素、光感色调、调性风格全部以参考图为准,**不要添加参考图中没有的人物 / 武器 / 道具 / 家具 / 围观角色 / 烟雾 / 血迹 / 任何额外元素**。动态元素仅限本 prompt 显式列出的几类(如衣袂残影 / 粒子 / 灯光氛围 / 速度线 / 虚化对手剪影),不要自由发挥。
[动作连贯性原则(v8.5 强制)]:本视频追求好莱坞大片级打斗(参考《疾速追杀》《伯恩谍影》《突袭》《卧虎藏龙》《一代宗师》《杀死比尔》《盗梦空间》《老男孩》等经典)。动作之间**不是切换、不是跳剪、不是 PowerPoint 翻页**——是**惯性带动下的自然过渡**:前一招的发力余势直接带出下一招的起势,身体重心连续流动,像水流不像分镜。每一击都有**物理重量感**(拳头落下的肉感反作用、衣袂随发力鼓荡、重心被冲击时的崩溃),让观众感受到力的传导。整段必须有**至少 1 处决定性瞬间(Decisive Moment)**——让观众屏息的电影海报级一帧(剑光及肤 / 兵器交锋 / 眼神锁定 / 凝视对手);以及**至少 1 处人物极限状态**——眼神特写或喘息表情,体现身体被推到极限。
[院线大片实时节奏原则(v8.6 强制)]:本视频是**院线大片实时打斗**,不是教学示范、不是套路演示、不是 pre-vis 慢动作回放。**默认全程正常速度(实时搏击节奏)**——招招到位、连消带打、招式不留余地、爆发与反应都在真实速度内完成。慢镜与凝固定格**只允许在 1-2 处使用**(仅决定性瞬间或戏剧反转),其余 80%+ 时长保持正常速度。**反例排除**:不要"逐招分解的教学回放"、不要"全程 0.5x 慢镜"、不要"每招都凝视聚焦"、不要"武术套路演示节奏"——参考的是《疾速追杀》连续过肩摔接抢射的实时连贯爆发、《伯恩谍影》肌肉记忆式的真实搏击速度、《突袭》连绵不绝近乎实时的打斗。
[海报 UI 元素排除]:参考图为多宫格 pre-vis 武指工作单,图中的阿拉伯数字编号 / 中文招式标题 / 中文要点说明 / 动作方向箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 任何文字标注均为海报注释层,**不要渲染到视频中**。视频是单一连贯的电影画面,不是多宫格拼贴,不存在格子分隔。
[场景与人物开场]:2-3 句开场画面描述,与 Step 1 人物锚定卡严格一致。
[镜头覆盖叙事(v8.3 强制必出,N 格全覆盖;v8.4 改用相对节奏)]:以一段流畅的电影旁白式动作描述(10-16 句,一气呵成、不要分段编号),按时间顺序覆盖图中 N 格 keypose 全部动作;叙事中用『接着』『随即』『紧接』『下一刻』等时间连接词把每一格动作串起来;每个动作后用**相对节奏标签**标注处理强度(不写具体秒数):
- **较长定格 / 完整演**——核心招、起势、收势、高潮决招(占比最重)
- **凝固瞬间 / 凝视聚焦**——节奏停顿点、关键定格、特写慢镜推近
- **短促一击**——爆发主攻、单击发力(节奏中等)
- **一笔带过 / 残影叠化**——过渡招、连接动作(节奏最快)
- **浓缩并击**——多招合并成连击(适合时长紧张时)
整段必须按「起势凝神 → 试探 / 第一次接触 → 爆发主攻 → 反转 / 转守为攻 → 高潮决招 → 收势凝望」六阶段戏剧弧线推进;关键招式要带具体身体动作 / 武器轨迹 / 衣袂飘动 / 对手反应(含虚化对手剪影);**N 格全部串起来不能跳过任何一格**。
[节奏比例提示]:1-2 句指引模型如何按用户选定的总时长分配——例如「起势与收势两段较长(合计约占 1/3 时长),中段连招紧凑,高潮决招处拉长成凝固定格(约占 1/4 时长),其余过渡招快剪一笔带过」。**不写具体秒数**,让模型按工具选定的总时长按比例缩放。
[镜头语言]:整段中的镜头切换与运动节奏,3-4 句(如低角度仰拍推进 / 横移跟拍 / whip pan 转场 / 360 度环绕 / 慢推拉远 等)。
[速度曲线]:起势 / 连招 / 高潮 / 收势各段的相对速度感,1-2 句(如「起势缓慢蓄势,中段正常速度推进,高潮处超慢镜叠凝固定格交替,收势缓慢拉远」)— **不写具体倍数**。
[环境互动]:贯穿全段的环境元素(粒子 / 衣袂 / 残影 / 雾气 / 灯光氛围 等,**只限本 prompt 列出的种类**),1-2 句。
═══ 使用建议(仅供你参考,不要复制进 prompt)═══
【建议总时长】根据镜头覆盖叙事的密度,建议在工具 UI 里选 **5s / 10s / 15s** 之一——N 格全演 + 密度高 → 选 10-15s;只演核心连招 → 选 5s。模型会按你选的总时长,结合 prompt 中的相对节奏标签自动分配每招比例。
【视频模型参数建议(平台中立,不点具体模型 / 平台名)】根据你手头工具的 UI 设置自行匹配:运动幅度档位(小 / 中 / 大)/ 一致性档位(保人物 / 保风格 / 双重保留)/ 宽高比(16:9 横屏 / 9:16 竖屏 / 1:1 方形)/ 帧率(24 fps 电影感 / 30 fps 流畅)/ 风格关键词(写实人体动力学 / 飘逸特效 / 长镜头慢镜 / 多角色互动 等,按本视频实际特征列 2-3 个)。
【一致性档位选择窍门】为了减少模型自由发挥添加图里没有的元素,建议**优先选「保风格 + 保人物」双重保留**,运动幅度选「中」而非「大」(运动幅度太大模型容易脑补额外内容)。
【配套图片】使用 Step 3 生成的多宫格海报作为视觉参考图(first frame / style reference)。
【图生视频工作链质量硬约束(v9.3 新增)】用户喂给视频模型的参考图必须满足:
- **分辨率**:建议 1024×1024 以上(视频模型对低质量首帧会"放大瑕疵")
- **三层纵深**:图中有清晰的前景 / 中景 / 背景,让视频模型有空间做镜头运动(推 / 拉 / 横移 / 环绕)
- **角色面部 + 手部清晰**:模糊的面部 / 抖动的手指会在视频中被加倍放大
- **充足负空间**:主体周围留出空间让模型做镜头运动而不必凭空生成新内容
- **短段更稳**:建议视频时长 ≤15 秒(行业实测:>15 秒首帧"记忆"开始衰退、角色 / 场景一致性下降)
- **统一光线方向**:图中光线方向贯穿全图,避免视频生成时光线"飘移"
整段叙事流畅 :写成一段电影旁白,而不是分段编号的清单
N 格全覆盖(v8.3 强制) :镜头覆盖清单中 N 格全部列出,每格在视频里都有处理方式(完整演 / 一笔带过 / 凝视聚焦 / 浓缩并击),不能跳过任何一格 ;时长不够就压缩单格时间,不能丢镜头
保留关键 keypose :起势仪式感 + 1-2 个高潮定格 + 收势仪式感 必须用「完整演」处理
保留虚化对手剪影 :如果原 N 招里有对手参照招,视频 prompt 中至少保留 1 处虚化对手剪影
承接 Step 3 的人物 / 服装 / 兵器 / 场景 :避免视频与图片人物漂移;同时显式排除海报 UI 元素 (编号 / 箭头 / 中文标题 / 重心轨迹线 / 格子边框 / 网格分隔线)
好莱坞大片打斗 7 要素必含(v8.5 升级,缺一即重写) :对标《疾速追杀》《伯恩谍影》《突袭》《老男孩》《疯狂麦克斯狂暴之路》《卧虎藏龙》《一代宗师》《盗梦空间》旋转走廊、《黑客帝国》《杀死比尔》《角斗士》等国际经典——不是堆砌招式,而是用电影级语法讲打斗故事:
决定性瞬间(Decisive Moment) :至少 1 处让观众屏息的视觉锚点——剑光及肤的瞬间 / 拳头逼近上身要害定格 / 兵器交锋火花溅起 / 眼神锁定对手的电影海报级 frame;这是观众最终会记住的那一帧(参考:杀死比尔黄衣新娘剪影 / 角斗士最终对决凝望 / 盗梦空间走廊翻转那一刻)
物理重量感(Impact Weight) :每一击都有重量——拳头落下时的肉感反作用力、刀刃斩入的阻滞感、身体被撞击时的衣袂鼓荡 + 重心崩溃;不是漂浮的 CG 招式(参考:突袭 / 伯恩谍影的肌肉记忆实战感、叶问寸劲爆发)
运动惯性与自然过渡(Momentum Carry) :动作之间不是切换,是惯性带动下的自然延续 ——前一招的发力余势带出下一招的起势,像水流而不是 PowerPoint 翻页(参考:一代宗师叶底藏花的"形未到劲先到"、疾速追杀连绵不断的过肩摔接抢射)
节奏对比(Tempo Contrast) :慢镜 + 正常速 + 凝固定格 至少包含两档;尤其要有「快慢交替的呼吸感 」——长段连续打 + 突然减速凝固 + 再加速(参考:黑客帝国子弹时间 / 杀死比尔慢镜定格 / 疾速追杀战术换弹的呼吸点)
空间立体纵深(Spatial Depth) :地面低桩 + 中段贴身 + 腾空高位 至少出现两层;同时画面要有前景 / 中景 / 背景 三层调度,避免动作只在一个高度 / 一个景深平面(参考:盗梦空间旋转走廊三层重力空间、突袭 2 厨房战的纵深)
环境作为参与者(Environment as Actor) :墙 / 桌 / 灯 / 门 / 雨水 / 雪花 / 尘土 / 碎玻璃成为打斗的一部分,不只是背景板——招式与环境互相塑造(参考:成龙体系道具化招、疯狂麦克斯狂暴之路的车体即武器、老男孩走廊的墙体反弹、突袭的厨房用具)
人物极限状态(Character at Limit) :眼神 / 表情 / 喘息 / 微表情体现身体极限与心理压力——观众感受到的不只是动作,是一个人被推到极限的状态;至少 1 处眼神特写或表情凝望(参考:伯恩谍影的疲惫眼神、突袭的累积疲劳、角斗士目视斜上方的觉悟瞬间)
图视频耦合性(连贯性核心) :Step 3 图片 prompt 中每一格 keypose 都要写成「运动中的瞬间 」——例如"剑刚劈到一半"、"拳头正向上身要害推进中"、"脚刚离地腾空起跳"、"长枪正在出手前的蓄势"等纯动作过程描述——而不是"已经完成的最终定格姿态" 。这样视频 prompt 的运动过程才能从图的瞬间自然延续下去;如果图是死姿态,视频开场会"重新启动",造成动作脱节。注意 :写"运动中的瞬间"时严禁用"距脸 X cm"、"距喉 X cm"等具体距离致命点描述(违反 B 类暴力软化),改用"正向 X 推进中"、"逼近上身要害"等戏剧性表达
戏剧弧线 :视频 prompt 的叙事必须符合「起势凝神 → 试探 / 第一次接触 → 爆发主攻 → 反转 / 转守为攻 → 高潮决招 → 收势凝望 」的打斗故事结构,每个阶段对应一段连贯动作;不是把 N 招按编号一字排开,而是讲一个有起承转合的打斗段落
视频生成模型(Sora 2 / Kling / 即梦 / Seedance / Veo / Runway)对版权关键词有严格的内容过滤。Step 4 的视频 prompt 必须把所有专有名词替换为视觉特征描述 ——否则会被 filter 拒绝、强制改写成 generic 角色、或生成结果失去预期辨识度。
判断准则(agent 自主识别专有名词,不套硬编码清单) :
每写一段 prompt,扫描其中是否含以下任何一类专有名词 :
角色名 :任何具体动漫 / 影视 / 小说 / 游戏作品中的命名角色(无论是中文还是外文)
作品名 :任何具体动漫 / 影视 / 小说 / 游戏的名称(《XX》《XX 大陆》《XX 之歌》等)
武器 / 技能 / 武魂 / 法术 / 招式专名 :作品中独有的命名(带专属词的"XX 锤"、"XX 诀"、"XX 拳"、"XX 印"等)
门派 / 组织 / 势力名 :作品中虚构或现实门派的具体名称
特定地点名 :作品中虚构或现实可识别地点("XX 山"、"XX 森林"、"XX 城"——可识别即风险)
真实人物名 :现实中知名武术家 / 演员 / 导演的本名
任意一类命中 → 必须脱敏 (A 模式 IP 题材 / B 模式桥段还原 都适用)。
去名留形 :去掉可识别的专有名词,保留视觉特征(年龄 + 性别 + 体型 + 服装 + 武器 + 气质 + 武修身份)。例如不写角色名,改写"一位约 25 岁的清秀少年武修,黑色立领长衫束发,手持暗金色巨锤"——视觉信息齐全,但 AI 模型推测不出具体 IP
武器用视觉描述替代专名 :写"颜色 + 材质 + 形态 + 光效"(如"银白长剑剑身泛冷光"、"暗金色巨锤雷光环绕"、"蓝银色发光藤蔓"),而非招式专名
作品调性用泛化风格词替代 :写"国漫玄幻 3D CG 风"、"中式修真动画风"、"写实武侠电影风"、"日式赛璐璐战斗动画风"等通用风格关键词 ,而非具体作品名
门派用服装气质替代 :写"黑色立领武修长衫"、"暗红色法袍金色滚边"、"灰布僧袍剃度",而非门派名
地点用环境调性替代 :写"暗夜幽蓝灵气古战场森林"、"古风高耸石塔屋顶"、"云雾缭绕道观山门",而非具体地名
首次出现用视觉锚点 :避免开篇用"他 / 她",首次出场写"一位约 25 岁的中国男性武修,眉宇带杀气、持灰白短刀"等带完整视觉锚点的描述,再用代词延续
是否含任何"读者一看就知道是哪个 IP / 哪部作品 / 哪个角色"的可识别专名?
如果有,能否用视觉特征 + 风格调性 + 武修身份 重写,让画面同样有辨识度但不暴露专名?
重写后视觉一致性是否还在?(图片 prompt 与视频 prompt 中的人物 / 武器 / 场景描述必须严格对得上)
简记 :A 类合规的判断由 agent 动态完成,软化方向由 agent 灵活选择,不存在固定对照表 ——因为不同题材的脱敏需求差异很大,硬编码反而限制 agent 判断力。
类别 A 版权脱敏 :Step 3 图片 prompt 按工具严格度自行决定 (中文绘图工具对中文版权词较宽松,可保留部分增强辨识度;国际工具较严需脱敏);Step 4 视频 prompt 零容忍含专有名词 。例外(v10.2) :当用户自带角色参考图 时,按 Step 3 规范 13b,图片与视频 prompt 的角色块引用「参考图挂载名」 (如 @女主,不是参考图人物的真实角色名 / IP 名)——因为引用的是参考图标签而非真实身份名,本身不触发脱敏问题;其余 IP 专名(作品名 / 武器专名 / 门派名 / 地点名)仍按脱敏规则处理。
类别 B 暴力软化 :Step 3 + Step 4 都强制必出 ——主流图片绘图模型(即梦 / Seedream / Midjourney / DALL-E / 通义万相 等)也都有暴力 / 血腥 / 致命描述过滤,会拒绝 prompt 或强制改写成 generic。图片虽然是静态、单张冲击可控,但"距喉 X cm"、"锁住颈部"、"刀刃逼近咽喉"、"血珠悬空"等仍会被拦截。
类别 C 平台中立 :Step 3 + Step 4 都强制必出 ——结尾不点具体绘图 / 视频工具名,统一用"主流 AI 绘图工具" / "主流 AI 视频生成工具"中性描述。
简记 :A 看绘图工具决定,B 和 C 在 Step 3 和 Step 4 都零容忍。
类别 B:暴力 / 血腥 / 致命描述软化(强制必出,与版权脱敏并列)
视频与图片审核都会拦截过于直白的暴力 / 致命 / 窒息描述,必须做戏剧性软化。但 agent 不应套硬编码对照表机械替换 ——而是按以下判断准则 + 软化方向 ,自主审查 prompt 中每一个动作动词,找到既合规又保留戏剧张力的表达。
是否直接描述武器命中身体? (如"斩腕"、"刺胸"、"砍腿"、"贯穿要害"——直接动词 + 具体身体部位)
是否有具体距离致命点的数字? (如"距喉 1cm"、"刀尖距脸 3cm"——任何具体距离单位 cm/寸/厘米)
是否有血腥词? (血 / 血珠 / 染血 / 喷血 / 溅血 / 渗血——pre-vis 与电影武指语言中都不出现)
是否明确死亡 / 致命结果? (毙命 / 取性命 / 致命 / 决死 / 死亡威胁 / 杀至)
是否有窒息 / 物理压迫直白词? (锁喉 / 勒颈 / 绞杀 / 窒息 / 扼颈)
是否含具体未成年岁数? (16/17 等具体未成年数字——所有角色默认 18+)
是否含真实枪械描述? (手枪 / 步枪 / 突击步枪 / 狙击枪——武术题材不建议使用)
任意一条命中 → 必须软化。 但软化不是阉割张力,是用电影武指语言 重新表达同样的戏剧冲击。
强调过程而非结果 :把"命中"/"贯穿"改为"推进中"/"逼近中"/"擦过"——动作过程描述比结果描述更有电影感
强调反应而非伤害 :把"斩腕"改为"震开持械腕、武器脱手"——结果通过对手反应传达,不直接描述伤害
环境与物理反馈替代血腥 :用"衣袂破损"/"火星溅起"/"重心崩溃"/"雪沫飞溅"/"金属碰撞"——观众从环境反馈感知冲击力
氛围词保留张力 :用"决胜瞬间"/"凝固定格"/"屏息时刻"/"剑指要害位置"——保留戏剧紧张感而不写具体血腥
武指美学语言替代直白动词 :剑势压向 / 剑光擦过 / 招式被格挡 / 锋芒所指 / 劲道贯穿 / 力透甲胄——电影武指本身就有这套成熟的间接表达词典,agent 应灵活调用而非套清单
格挡 / 闪避主导叙事 :写"被格挡"/"闪过"/"招架"——让招式始终处于"未命中"状态,戏剧张力反而更足
合规不是阉割,是更精致的表达。 真正高级的电影武指本来就不靠血腥取胜——《一代宗师》的桥手细节、《英雄》的衣袂雪花、《卧虎藏龙》的剑光弧线,都没有任何直白暴力词,但戏剧张力满到溢出。
agent 写完每段 prompt 后,逐句自检 :
这句话有没有上面 7 条命中?
如果有,能不能用过程 / 反应 / 环境 / 武指美学语言重写,让它既合规又比原版更有电影感 ?
软化后,戏剧张力是不是还在?(如果张力消失了,说明软化方向选错了,重选)
18+ 与冷兵器优先(硬约束) :所有角色默认 18+,严禁具体未成年岁数;武术题材优先冷兵器(剑 / 刀 / 棍 / 锤 / 暗器 等),需要远程武器时用"机械装置"/"投射工具"/"远程能量"等抽象表达,不写真实枪械型号。
类别 C:平台中立(视频 / 图片模型不点名,强制必出)
Step 4 视频 prompt 中严禁出现具体视频模型 / 平台名 (无 sora / kling / 即梦 / seedance / veo / runway / midjourney 等具体平台或产品名),改成通用参数维度描述:运动幅度(小 / 中 / 大)/ 一致性档位(保人物 / 保风格 / 双重保留)/ 宽高比 / 帧率 / 风格关键词。理由三条:
模型迭代极快 ——写死会过时
平台中立 ——避免商业敏感与广告嫌疑
用户可能用任何工具 ——由用户自行匹配手头资源
Step 3 图片 prompt 同理:结尾"建议复制到 XX / XX / XX 工具"改成中性描述如"建议复制到主流 AI 绘图工具,画面比例 1:1 或 4:3"。
═══ 第 N 格 / 招式名 ═══
【A. 单格高清图提示词】(150-250 中文字符,纯文本,可直接喂主流 AI 绘图工具)
一段连贯的中文描述,融合:高清写实线稿风格锚定(黑线白底、排线 / 影线表达体积明暗、不上色、可还原 8K IMAX 写实)+ 人物锚定卡完整描述(避免漂移)+ 该招的具体动作(朝向 / 重心 / 肢体)+ 镜头景别与角度 + 光线方向(以线条疏密表达明暗)+ 兵器状态(如有)+ 环境互动(简洁结构线表透视纵深)+ 风格关键词;排除色彩填充 / 照片级上色 / CG / 二次元 / 水印。
【B. 图生视频提示词】(基于 A 生成的图作为起始帧;可直接喂即梦 / Kling / Seedance / Sora / Runway)
- 起始帧:[描述图片中的初始定格姿态,2-3 句,必须严格对应 A 生成的画面]
- 运动过程:[动作如何展开——肢体轨迹 / 武器轨迹 / 衣袂飘动 / 特效延展 / 对手反应,3-5 句]
- 结束帧:[动作收束的姿态,2-3 句,与下一格的起始帧自然衔接]
- 镜头运动:[固定 / 推 / 拉 / 跟随 / 环绕 / 横移 / whip pan / 慢镜推进 — 必须明确选一种]
- 速度曲线:[示例:0-2s 慢镜起势 → 2-4s 正常速度 → 4-5s 末段定格凝固]
- 环境互动:[雪花飞起 / 血珠飞溅 / 刀光残影 / 灵气粒子 / 落叶 / 尘土 等]
- 建议时长:[5s / 8s / 10s — 多数模型 5s 是甜蜜点]
- 推荐视频模型:[即梦 4.0 / Kling 1.6 / Seedance / Sora 2 / Runway Gen-4 — 必须给出理由:写实硬派 → X,飘逸特效 → Y,慢镜暴力 → Z]
起始帧严格对应 A :B 的起始帧描述必须能在 A 生成的图里找到对应,不能脱节
结束帧考虑衔接 :除最后一格外,结束帧应能自然过渡到下一格的起始帧(剪辑成连贯打斗)
速度曲线服务于戏剧节奏 :进攻招用快、定格瞬间用凝固、起势收势可用慢镜
模型推荐有依据 :根据该招的视觉特征匹配模型擅长项——写实人体优先 Kling / Sora 2,二次元玄幻优先即梦 / Seedance,运动幅度大优先 Kling,长镜头慢动作优先 Sora 2
整段连续打斗视频的剪辑提示 :N 格视频片段产出后,按编号顺序拼接,关键招式之间可加 0.5s 跳切或 whip pan 转场;起势与收势用全长慢镜,中段进攻用快剪。
Step 5|质量自检 输出主提示词前对照 checklist,不通过则改完再输出:
角色替换工作流(白模 → 用户上传人物图,v8.3 新增) 适用场景 :用户已经按白模 pre-vis 出了一张多宫格海报(Step 3)+ 视频 prompt(Step 4),现在想用自己上传的角色图替换白模——可能是:
真人模特照片
自定义虚拟角色(动漫风 / 写实风 / 风格化)
已有 IP 角色图(用户自己拥有授权的)
之前生成过的人物图(保持系列一致性)
核心思路 :动作 / 场景 / 调性 / 镜头设计全部保留 ,只替换「角色块」。本 skill 在 Step 3 提示词里已经把「演武者描述」写成了一段自成一段的角色块(写作规范第 13 条),就是为了让这一步替换变得简单。
三种替换路径(按工具能力分档) 直接把 Step 3 提示词中的「演武者为同一位 ... 全程保持同一人物」整段替换为用户人物的具体描述(外貌 + 服装 + 体型 + 三个特征锚点),其余动作 / 镜头 / 场景 / 调性段落原封不动。
演武者为同一位纯白色 3D 白模人形 / 表面无纹理 / 关节线条清晰,修长精瘦男性体型,
头束简洁布带 / 腰系窄腰带 / 持械护手等极简符号,全程保持同一人物。
演武者为同一位{{用户人物外貌:如约 28 岁中国男性 / 短黑发利落分头 / 剑眉星目 / 修长精瘦
体型}},穿{{用户人物服装:如黑色立领暗纹武修长衫 + 灰色束腰带 + 黑布靴}},
{{三个特征锚点:如左眉骨有浅疤 / 右手腕缠护腕 / 沉稳冷峻气质}},全程保持同一人物。
适用场景 :用户已知人物的外貌特征但没有现成参考图 ,或工具不支持图像参考输入。
路径 B|图像参考(i2i / character reference,主流 AI 绘图工具普遍支持)
如果绘图工具支持「角色一致性参考图」「character reference」「i2i 主体融合」「主体 LoRA」等功能,更高效的做法:
把路径 A 的「文字角色块」简化为短描述(不必写得太细,让参考图说话)
上传用户人物图作为「角色参考」
同时上传 Step 3 生成的白模海报作为「构图 / 动作参考」(如果工具支持双图参考)
或者把角色参考权重调高(70-90%)+ 海报作为风格参考权重低(30-50%)
演武者为同一位中国男性武修(参考用户上传图),全程保持参考图人物特征不漂移;
穿黑色立领武修长衫,姿态体格按下方动作描述演绎。
适用场景 :用户有具体参考图、希望角色辨识度高、保持系列一致性。
路径 C|分两步出图(最稳定,适合复杂或动漫风角色)
当用户角色风格特殊(比如二次元、特定画风、有独特配饰),路径 A、B 都可能漂移,更稳的做法:
第一步 :用 Step 3 提示词原样跑一张白模海报(确认动作 / 镜头 / 场景设计正确)
第二步 :把白模海报 + 用户人物图同时输入到「主体替换 / inpaint / character swap」类工具中,单独跑一次「保留构图 + 替换角色」
如果工具不支持 N 格批量替换,可以逐格替换 (或先剪裁出每一格白模 + 用户人物图 → 单格替换 → 拼回 N 宫格)
适用场景 :动漫角色、特殊画风、保持精确动作但角色风格差异大。
Step 4 视频 prompt 的角色替换
找到视频 prompt 中「[场景与人物开场]」段落里的人物视觉描述
用相同的逻辑替换(路径 A 文字替换 / 路径 B 给视频模型上传角色参考图 + 海报)
「镜头覆盖清单」「完整打斗叙事」「镜头语言」「速度曲线」「环境互动」等其他段落全部保留
大部分视频生成工具支持「reference image / first frame」——把替换后的多宫格海报或单张角色图作为 first frame,视频 prompt 描述会自动按新角色演绎
替换工作流的 3 条注意事项
服装与动作的兼容性 :用户人物的服装如果是宽袍 / 长裙 / 高跟 / 紧身机能,需要回看原 N 招的姿态配额——比如低桩仆步 + 高跟会卡顿,腾空踢 + 长裙会画得很糟。提醒用户:「该套动作的最低桩 / 最大腾空在 X 招,如果你的角色服装是 Y,建议 ...」
调性兼容性 :暴力美学 + 萌系动漫角色、写意武侠 + cyberpunk 机能服 这种调性冲突,会让 AI 风格分裂。建议用户在替换角色前确认调性匹配
保留 Step 3 + Step 4 原版本 :替换前先备份原始白模海报和视频 prompt,方便对比效果或回退
红线
不调任何 API 实际生成图片 ——本 skill 只产出文本提示词,由用户拿去喂给绘图工具
不做"轻微换姿势" ——如果检查发现两格视觉差异不足,必须重选其中一招
不省略人物描述 ——多宫格里 AI 是把每一格当独立画面渲染的,主提示词中人物特征必须以"全程保持同一人物"硬性要求出现
不发明武术流派 ——只用 references/martial-arts-systems.md 中已列出的体系;用户给的体系不在词典内时,先告知并请其确认
不混用调性 ——一份海报只能一种调性(写意 vs 暴力美学不能混),调性不一致会让 AI 出图风格分裂
不发明用户没指定的桥段细节 ——B 模式(桥段还原)下,AI 对原作品的"训练记忆"必须先告知用户并请求确认;如无可靠记忆直接告知用户并请其详细描述。绝不能编造自己没把握的招式或情节
视频提示词必须配套图片,且必须是一整段连贯描述 ——Step 4 的视频 prompt 是「一整段从起势到收势的连贯电影叙事」,严禁拆成 N 段碎片让用户自己拼接 ;视频 prompt 要与 Step 3 的图片 prompt 在人物 / 服装 / 兵器 / 场景上严格一致,让视频模型把图里的人物"活过来"按 prompt 演一段完整连贯的视频;必须根据推荐视频模型的时长上限做"招式精简编排",不要把 N 招全塞进 5s
视频 prompt 必须三重合规化(版权 + 暴力 + 平台中立,零容忍) ——视频生成模型的 content filter 极严,会从三个维度同时拦截。
类别 A 版权脱敏 :所有专有名词(角色名 / 作品名 / 武器名 / 武魂名 / 技能名 / 门派名 / 特定地点名)必须替换为视觉特征描述(颜色 + 材质 + 形态 + 光效)
类别 B 暴力软化 :血 / 锁喉 / 绞杀 / 致命 / 决死 / 距喉 X cm 等过直白描述必须戏剧性软化(替换为"颈部控制"、"决胜瞬间"、"逼近上身要害"、"劲道贯穿"等);保留张力但不写血腥与具体致命点;默认所有角色 18+,严禁出现具体未成年岁数 ;不用真实枪械描述
类别 C 平台中立 :严禁出现具体视频 / 图片模型 / 平台 / 产品名(无 sora / kling / 即梦 / seedance / veo / runway / midjourney 等具体名称),改成通用参数维度(运动幅度 / 一致性档位 / 宽高比 / 帧率 / 风格关键词)
三类映射表与原则见 Step 4「Prompt 合规化改写」模块。Step 3 图片 prompt 强制遵守 B + C 两类 (图片审核同样严格,"距喉 X cm" / "锁住颈部" / "血珠悬空" / 平台名 等都会被拦截或强制改写;A 类版权脱敏可视绘图工具严格度自行决定);Step 4 视频 prompt 三类全部零容忍
视频 prompt 必须显式排除海报 UI 元素(v8.3 强制必出,零容忍) ——图片中的「编号 / 中文招式标题 / 中文要点说明 / 动作方向箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 任何文字标注」是 pre-vis 武指工作单的注释层,不是画面内容 。视频 prompt 必须在最前段显式声明排除这些 UI,否则视频会带着箭头 / 编号 / 文字一起渲染,毁掉电影感。视频画面应只包含:演武主体 + 武器 + 环境 + 灯光 + 残影粒子。
视频 prompt 必须包含镜头覆盖清单(v8.3 强制必出) ——N 格全部列出,每格在视频中都有处理方式(完整演 / 一笔带过 / 凝视聚焦 / 浓缩并击),严禁跳过任何一格导致视频镜头缺失 ;时长不够就压缩单格时间,不能丢镜头
角色描述模块化(v8.3 强制必出) ——Step 3 提示词中的「演武者外貌 + 服装」必须写成自成一段的角色块(开头「演武者为同一位 ...」结尾「全程保持同一人物」),便于用户后续替换为自己的角色图;禁止把人物特征零散散布在多个招式要点里
正文与使用建议必须严格分离(v8.4 强制必出) ——视频 prompt 必须输出两个独立块:「视频 prompt 正文」(用户复制喂给视频模型)+「使用建议」(用户看的工具配置说明)。「建议总时长」「运动幅度档位」「宽高比」「帧率」「风格关键词」等是工具 UI 参数,严禁塞进 prompt 正文 ——模型读到只会困惑或忽略,反而稀释正文有效信息密度。Step 3 图片 prompt 同理:「整体效果参考」是给模型看的(可保留),「建议复制到 XX 工具」「画面比例 1:1」等是给用户看的(必须放外部说明)。
节奏用相对描述,不写绝对秒数(v8.4 强制必出) ——视频生成模型的总时长是工具 UI 参数(5/10/15 秒),prompt 里写「1.5 秒完整演」「0.6 秒凝固定格」「0.3 倍超慢镜」会与工具实际时长冲突或被模型忽略。必须改用相对节奏词 (较长定格 / 短促一击 / 凝固瞬间 / 一笔带过 / 浓缩并击 / 起势段较长 / 中段紧凑 / 高潮拉长 / 收势缓慢 / 关键招与过渡招比例约为 X:Y),让模型按用户选定的总时长按比例自动分配。
忠于参考图,禁止凭空添加(v8.4 强制必出) ——视频生成模型在 i2v 时容易"自由发挥"添加图里没有的人物 / 武器 / 道具 / 桌椅家具 / 围观角色 / 烟雾血迹 / 文字标识 / 未指定特效。视频 prompt 必须显式声明「忠于参考图原则」写在正文最前段 :人物数量、武器形态、场景元素、调性、服装细节都以参考图为准,不增不减;动态元素仅限 prompt 中明确列出的几类(如衣袂残影 / 粒子 / 灯光氛围 / 速度线 / 虚化对手剪影),不能自由发挥
好莱坞大片打斗 7 要素 + 动作连贯性(v8.5 强制必出,缺一即重写) ——本 skill 的最终输出对标好莱坞 / 国际经典打斗(《疾速追杀》《伯恩谍影》《突袭》《卧虎藏龙》《一代宗师》《杀死比尔》《盗梦空间》《老男孩》《疯狂麦克斯》《角斗士》等),不只是国产武指底线。视频 prompt 必须包含:
决定性瞬间(屏息 frame) :至少 1 处让观众屏息的电影海报级一帧
物理重量感 :每一击有肉感反作用力 / 衣袂随发力鼓荡 / 重心崩溃感
运动惯性自然过渡 :动作之间不是切换是惯性带动,前招余势带出后招起势,像水流不像 PPT 翻页(本要素是「动作连贯性」的核心)
节奏对比 :慢镜 / 正常 / 凝固 至少两档;尤其要有"快慢交替的呼吸感"
空间立体纵深 :地面 / 中段 / 腾空 至少两层;前景 / 中景 / 背景 至少两层
环境作为参与者 :墙 / 桌 / 灯 / 雨水 / 雪花 / 尘土 / 碎玻璃 与招式互相塑造
人物极限状态 :眼神特写或表情凝望体现身体极限与心理压力