| name | fanren-xiuxianzhuan-2d-zhuanhui |
| description | 按用户指定的视觉风格,先通过代表性片段小样实验和用户确认锁定风格,再将原始影视片段批量转绘为统一的原创二维动画视频;适用于 GPT Image 2 故事板、MiniMax H3 Ref2VA、ComfyUI 串行生成、原声音轨替换和全量 QC。 |
| metadata | {"display_name":"凡人修仙传2d转绘","default_resolution":"1376x768","default_fps":"24","default_audio":"source_audio"} |
凡人修仙传2d转绘
这是一个可迁移到不同项目目录、不同视觉风格的“原视频 → 风格化故事板 → H3 视频 → 原声音轨成片”工作流。风格由用户指定,可以是某种二维动画、绘画、版画、纸片、手绘或其他明确的视觉方向;Skill 不预设 Paprika、某个电影或某个固定色板。默认输出为 768p(1376×768、24fps),不把原视频送入 H3,只使用原视频做内容分析、抽帧和取回原音。
什么时候使用
当用户希望把一批影视片段统一转成用户指定的原创二维风格时使用。用户可以引用某部作品作为气质参考,也可以直接描述线条、色彩、材质、光线、构图和运动方式;引用作品只作为高层视觉启发,不复制其人物、具体镜头或画面。实际内容、人物、动作和镜头顺序必须来自用户自己的素材。
开始前先读:
- 标准流程:输入、目录、故事板、H3、音轨和交付规则。
- 提示词模板:GPT Image 2 故事板和 H3 Ref2VA 的通用模板。
- 风格测试与锁定:如何做小样、记录反馈、确认风格并切换到全量生产。
- 批量任务再读 批处理与 QC。
不可改变的核心约束
- 原视频只用于盘点、ffprobe、关键帧/内容网格分析和最终音频来源;禁止把原视频、原始关键帧或内容网格作为 H3 的视频参考或图像参考。
- H3 只接收当前片段的“无台词、无水印、无乱码”的风格化故事板。
- H3 生成的声音全部丢弃;最终音频来自对应源视频,优先 stream copy,并用 PCM SHA256 核对。
- 默认按源片段完整时长生成:
H3 length = round(source_duration × 24) + 2。不能因为超过 15 秒就硬裁或拆段;只有节点上限、OOM 或同一完整时长连续失败时才拆段。
- H3 必须串行提交,一段完成、合成、QC 后再提交下一段,避免显存抢占和 prompt_id 混淆。
- 画面必须服从“已锁定的用户风格规范”。如果用户没有明确指定,先提出 2–3 个可执行的风格方向并用小样确认;不要把本 Skill 的示例色板或明亮留白误当成硬性风格。无论何种风格,都禁止无意义密集细节、生成式乱码、字幕、水印和 logo。
- 不覆盖源视频、描述文本、原工作流或既有成片;新文件使用版本化文件名。
推荐执行顺序
确认用户风格需求 → 选择代表性片段做小样 → GPT Image 2/H3 试验 → 展示小样并收集反馈 → 记录并锁定 style lock → 盘点全部输入 → 解析 Shot 时间 → 原片抽帧做内容网格 → 按锁定风格生成无台词故事板 → 生成准确台词查看版 → 编写六段 H3 Ref2VA prompt → 注入 768p API workflow → 串行提交 H3 → 用源视频音轨合成最终片 → 抽帧视觉 QC → 技术/音频/清单 QC → 可选地串联所有最终片段。