بنقرة واحدة
image-generation-plan
通用图片生成计划技能。用于把故事、剧本、镜头组、制作包或已有资产整理成逐张生成图片的 TOML 计划,明确生成顺序、保存路径、参考图、画幅和提示词;默认只写计划,不提交生成任务。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
通用图片生成计划技能。用于把故事、剧本、镜头组、制作包或已有资产整理成逐张生成图片的 TOML 计划,明确生成顺序、保存路径、参考图、画幅和提示词;默认只写计划,不提交生成任务。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
Create Chinese video cover images and thumbnails from a reference image, especially for AI/tech tutorial covers requiring exact Chinese title text, soft-light 3D-rendered portrait aesthetics, and exact 16:9, 4:3, and 3:4 aspect ratios. Use when the user asks to make, redo, or adjust cover images/thumbnails with a supplied reference image and Chinese text. Treat 3:4 as a strict ratio that must never be substituted with 2:3.
Codex/ChatGPT 专用的纯美术风格获取、提取、萃取、蒸馏和迭代技能。用户说 get style、distill style、extract style、style extraction、style distillation、获取风格、提取风格、萃取画风、反推风格等任何中英文类似意图时触发完整 pipeline:先判定参考图媒介大类(纯2D、纯3D渲染、2.5D、2D+3D混合、真实摄影),再真实生成候选图、读图对比、自我修正,至少完成2轮4类验证图迭代,并独立并发生成16张材质/纹理锚点图,最终产出可复用的新风格 skill 文件夹。禁止只输出提示词或只生成 prompt 文件。
通用 AI 图片质量闸门。用于在接受图片、作为后续参考、进入风格验证或交付前,检查文件可读性、任务 prompt/简报符合度、主体与身份、解剖和物理逻辑、参考图用途、构图可读性与通用生成伪影。适用于角色图、环境图、道具图、概念图、漫画页、风格测试图和批量图片计划。不负责判定候选图是否忠实匹配目标画风;风格匹配使用 validate-style-match。
图片美术指导 / 视觉质检技能。用于选择或审查参考图、判断候选图是否适合进入项目参考链路、复核生成图的内容/画质/风格一致性,并输出“可用 / 只作气氛参考 / 不可用”的明确结论。不要替代 image-generation-plan 的 TOML 编排,也不要替代 style-distill 的风格萃取迭代。
通用影视、短剧、动画、漫画和 AI 内容制作流水线。用于从故事梗概、零散设定或分集大纲出发,整理剧本、镜头组、资产清单、角色/场景/道具需求、图片计划和关键帧生产顺序,并用阶段门禁保证连续性与可执行性。
将剧本、故事梗概、口播稿、小说段落、广告脚本、短视频文案或零散剧情描述转化为面向 AI 图片、视频和漫画生成的 Markdown 镜头组文档。强调先按叙事任务整理镜头组,再在组内保留少量必要镜头节拍;单一分镜表只作为辅助,不作为默认核心产物。
| name | image-generation-plan |
| description | 通用图片生成计划技能。用于把故事、剧本、镜头组、制作包或已有资产整理成逐张生成图片的 TOML 计划,明确生成顺序、保存路径、参考图、画幅和提示词;默认只写计划,不提交生成任务。 |
| version | 1.0.0 |
| author | Hermes Agent |
| license | MIT |
| metadata | {"hermes":{"tags":["image-generation","production-plan","toml","prompts","creative-assets"],"related_skills":["creative-production-pipeline","image-art-direction","character-reference-pipeline"]}} |
当需要把故事、剧本、镜头组、制作包、漫画章节或已有资产,整理成一份“后续逐张生成图片”的 TOML 计划文件时,使用本技能。
本技能只规定 TOML 计划文件的格式、写法、信息完整度和约束纪律,不绑定任何具体项目画风。
只写计划,不生成图片
图片生成计划必须等镜头组之后再做
计划服从源文档
镜头组是概念剧照来源,不是单镜头表
角色和道具中心管理,先复用后新增
人物/<角色名>/ 下,不跟随单集目录反复生成;同一角色的图片直接放在同一个角色文件夹内,不再按 源头大头照/、立绘/ 等拆多层。道具/ 目录;如果剧情上是同一个道具(如锡杖、行囊、经卷、念珠、书箱、马鞍等),只能生成一张主参考图,后续各集只引用它,不要在每集 资产/EPxx/道具/ 下重复生成同名道具。人物/、道具/、前集资产索引和已生成图片;能复用的角色/道具先复用,只有剧情明确出现新道具、道具外观永久变化、损坏/打开/特殊状态需要单独表现时,才新增道具图。跨集角色只定一次源头脸
# todo 重新生成。路径、参考图、提示词必须可执行
约束写在计划里,不靠记忆执行
长篇计划默认用一层批次 TOML,不按资产类型拆计划目录
图片生成计划/ 目录默认保持一层:1.toml、2.toml、3.toml……;每个 TOML 对应一个分集 / 批次。[[tasks]] 的自然顺序就是本批次生成顺序。不要再额外维护 00_制作顺序/、制作顺序.md 或任务索引文档。01_主人物/、02_配角/、03_环境/、04_服装道具/、05_分集/。这些是资产分类思路,不是生成计划组织方式。target_image_path 仍可指向 资产/人物/、资产/道具/、资产/EPxx/场景/、资产/EPxx/概念剧照/ 等解耦保存路径。target_image_path 仍指向 资产/ 下的正确解耦路径。输出必须是 .toml 文件,不输出 TOML 计划正文,不使用 TOML 标题、引用块、勾选清单或单张图片条目模板。所有需要写给 agent 看的额外说明,写成 TOML comments:
# 《项目 / 集数 / 章节》图片生成计划
# 依据:镜头组_42集版/EPxx_xxx_镜头组.md;对应剧本:剧本_42集版/EPxx_xxx.md。
# agent执行规则:本计划用于agent模型生成图片;每一次生成时,传给agent的 prompt、reference_image_paths、aspect_ratio 和其他参数,必须严格遵照当前单独的 [[tasks]]。
# 任务顺序:每个计划文件内严格按 1) ENV/environment,2) objects/tools/props/clothes/costumes,3) CH/characters/roles,4) STILL/conceptual scene shots 排序。
[[tasks]]
id = "ENV-01"
target_image_path = "资产/EPxx/场景/S01_主空间.png" # todo
reference_image_paths = []
aspect_ratio = "16:9"
prompt = """..."""
TOML comments 的用途:记录源文档、范围、全局执行规则、生成顺序、重要资产约束和自检提示。Comments 只能辅助执行,不能替代任何单个 [[tasks]] 的字段;每个任务仍必须 self-contained。
必须用 # comments 说明:
必须用 # comments 说明:
base-art-style.md、base-style.md、art references/base-art-style.md),该文件就是基础画风的硬约束:提示词里的基础美术行必须逐字采用该文件内容或明确引用该文件,不得写近似改写版;提示词其他部分也不得加入与该文件媒介、渲染、材质、光影、色彩、对比度或细节密度相冲突的词语。# todo。通用提示词公式:
【基础美术风格】<电影项目只写硬摄影规格:摄影机型号、记录格式、镜头品牌/系列/焦段、T 值、画幅比例;保持为摄影部门语言>
【具体生成内容】<写主体、动作、地点、道具、状态、人数、构图目的>
【生成要求】<用正向语言写清本图必须满足的构图、身份、时代、画幅、背景、材质和参考图约束>
注意:
【基础美术风格】 不应混入具体人物、剧情、道具或项目专属设定。【基础美术风格】 应采用摄影部门语言,而不是抽象美术口号。必须明确摄影机和镜头型号,例如 ARRI ALEXA 35 + Cooke Anamorphic/i 40mm、Sony VENICE 2 + Panavision Primo 50mm 等;具体型号应服从项目统一摄影方案。【基础美术风格】 只放摄影机、记录格式、镜头系列/焦段、T 值、画幅比例等硬规格;不要写“安全构图、固定机位、光源依据、背景只交代空间、不使用现代柔光箱效果”等调度/说明文字,这些如必须出现,应放入具体生成内容且保持简短。【提示词】 内不能写 对应镜头组 EPxx-SGxx、本图只选择、如上文、本集、镜头组限定 等依赖外部文档的描述;每条提示词必须直接说明地点、人物、动作、道具、画面边界和禁项。电影感写实历史纪录片风格,唐代与西域佛教题材,克制构图,真实材质,低饱和暖冷对比,自然尘埃与体积光,空间真实可行,细节清晰但不过度堆砌,无文字无水印。 其中“真实材质、低饱和暖冷对比、自然尘埃与体积光、空间真实可行、细节清晰但不过度堆砌”等属于文学化/说明书化描述,应删掉或转化为具体摄影、灯光、镜头和场面调度信息。【具体生成内容】 承担主体、动作、地点和剧情信息;必须短句化、可直接投喂,不写制作备注或索引说明。概念剧照、画面表现、剧情说明、台词、长段故事前因后果,尤其不要把一段镜头组正文直接塞进提示词。图1用于场景空间和动线,图2用于玄奘身份与服装,图3用于麹文泰身份与服装 这类用途,并补充本张图特有的站位、表情、动作、景别变化。reference_image_paths 完全相同,说明环境相同、主要人物相同;除非两张图的动作、事件、人物关系、景别或镜头角度非常不一样,否则不要写第二条,应合并成一条或删掉后者。只靠不同对白、不同剧情说明、轻微表情变化,不能成立为第二张图。【生成要求】、negative prompt 或“不要/不得/禁止”句式里。改用正向约束,例如“纯白背景、单人正面头肩像、只呈现本任务角色、画面干净”。
-agent没有项目上下文。每个 [[tasks]] 的 prompt 必须 self-contained:直接写出画面里出现的主体、地点、动作、人数、道具、构图、光线、情绪和画面边界;不写“服务《某集》”“本段叙事”“源文档限定”“按画面需要”等依赖外部理解的句子。reference_image_paths 必须完整,并在 prompt 中用 图1、图2 的方式说明每张参考图的用途。不要在 prompt 里重复叙述参考图已经包含的细节,只写“图1用于空间结构 / 图2用于人物身份 / 图3用于道具形制”等用途。styled 前缀或后缀的版本;例如同时有 ballroom_16x9_styled 和 ballroom_16x9 时,优先选 ballroom_16x9_styled。没有 styled 版本时才使用普通版本。必须用 # comments 说明:
长篇 / 多集项目的图片生成计划应按分集批次组织成一层 TOML 文件,而不是按最终资产目录机械拆分。推荐结构:
图片生成计划/
README.md
1.toml
2.toml
3.toml
...
规则:
1.toml → 2.toml → 3.toml……;不要再写 00_制作顺序/、制作顺序.md 或单独索引文档。[[tasks]] 出现顺序生成;因此每个计划文件必须严格按 1) ENV/environment,2) objects/tools/props/clothes/costumes,3) CH/characters/roles,4) STILL/conceptual scene shots 排序。不要根据最终保存目录重排,也不要把 characters 放到 clothes/props/tools 之前。图片生成计划/ 拆成 01_主人物/、02_配角/、03_环境/、04_服装道具/、05_分集/。这些会让执行顺序和保存目录混在一起,增加维护成本。target_image_path 可以且应该按最终资产库组织:人物放 资产/人物/,道具放 资产/道具/,分集场景放 资产/EPxx/场景/,分集概念剧照放 资产/EPxx/概念剧照/。1.toml;如果人物 B 第一次在 EP04 登场,则归入 4.toml。但在任何一个文件内部,仍必须先写环境,再写 objects/tools/props/clothes/costumes,再写 characters/roles,最后写 conceptual scene shots。资产/道具/;后续批次只引用它。跨集角色源头脸、状态脸和立绘集中保存到 资产/人物/<角色名>/。N.toml 内的 [[tasks]] 自然顺序中;服装/衣物属于第 2 类,必须排在人物前;概念剧照必须最后。这种规则模拟实拍制片流程:按拍摄 / 剧情推进批次落实场地、服化道和演员状态;但资产保存仍保持制片资产库结构,便于跨集复用。
当用户要求“对照剧本 / 镜头组删除从来没有登场的内容”时,必须先做源文档盘点,再改 TOML;不要凭角色名直觉删除。
流程:
剧本_* 和 镜头组_* 目录内所有相关 .md,合并为可检索文本。N.toml,提取 id、target_image_path、reference_image_paths、prompt,并从 资产/人物/<角色名>/、资产/道具/<道具名>.png、任务 id 中抽取实体名。[[tasks]];如果它是后续任务参考图,先判断后续任务是否也应删除或改引用。id、target_image_path、reference_image_paths、prompt 内角色称呼和相关 资产/人物/<角色名>/ 路径,避免旧称呼残留。当用户指定使用 TOML 计划时,输出文件使用 图片生成计划.toml 或带集数/版本的同类文件名,根结构为任务数组:
TOML 文件开头必须写明agent执行规则:本计划用于agent模型生成图片;每一次生成时,传给agent的提示词、参考图和其他参数,一定要严格遵照当前单独的 [[tasks]],不能根据上下文、相邻任务、既有图片或角色印象自行修改、补全、串用参考图或沿用其他任务的人脸。
TOML 的 prompt 必须只使用正向提示词,不写 negative prompt;不要用“不要、不得、禁止、避免、不能、不可、无、没有”等方式列出排除项,也不要在负面句里提到不想出现的对象。把排除意图改写为正向画面约束。
每个 TOML 任务都必须独立可执行:参考图列表完整,prompt 说明 exact 画面内容;如果引用参考图,按 图1、图2 标注用途。生成计划不能假设agent知道剧本、镜头组、上下文或前后任务。
[[tasks]]
id = "CH-少年玄奘-FACE"
target_image_path = "资产/人物/少年玄奘/少年玄奘_源头脸部特写_3x4.png" # todo
reference_image_paths = []
aspect_ratio = "3:4"
prompt = """【基础美术】ARRI ALEXA 35,Open Gate 4.6K,Cooke Anamorphic/i 40mm,T2.8,2.39:1
【具体内容】少年玄奘源头脸部特写,视觉年龄8岁左右的男童,正面头肩像,干净中性背景,五官清晰,神情聪敏、恭敬、认真到近乎执拗,唐代士族儿童衣冠气质,作为后续同一张脸的身份锚点。
【生成要求】纯白背景,单人正面头肩像,身份清晰,画面干净,服饰和时代质感服从本任务"""
TOML 任务类型等价于:
type ImageGenerationTask = {
id: string
target_image_path: string // 若图片暂时不存在,行尾注释 # todo;若已存在且本轮未改提示词,行尾注释 # done;若本轮修改了该任务提示词或参考图,即使图片文件已存在,也必须改为 # todo
reference_image_paths: string[]
aspect_ratio: string // 建议画幅,如 "3:4"、"2:3"、"1:1"、"16:9"、"9:16";必须服务图片类型与主体形状
prompt: string // [基础美术]+[具体内容]+[生成要求];禁止使用 negative prompt
}
type ImageGenerationPlan = ImageGenerationTask[]
当前项目默认图片资产目录:
资产/
人物/
角色名字/
角色名_源头脸部特写_3x4.png
角色名_立绘_.png
道具/
道具名.png
EP1/
场景/
场景名.png
概念剧照/
名.png
路径写法要求:
target_image_path 和 reference_image_paths 使用相对路径,不使用绝对路径。aspect_ratio 是必填字段;角色脸部特写通常用 3:4;单人单面全身立绘可用 2:3;正反同框立绘必须用 1:1;细长竖向道具优先 9:16 或 2:3;环境与概念剧照常用 16:9,具体以主体形状和后续用途为准。资产/人物/<角色名字>/;道具统一放入 资产/道具/;分集场景与概念剧照放入对应 资产/EPxx/场景/、资产/EPxx/概念剧照/。# done 表示现有图片可以继续沿用;# todo 表示需要重新生成或首次生成。prompt、reference_image_paths、身份年龄或关键约束,该任务必须标为 # todo,不能因为目标图片文件已经存在而保留 # done。脸部大头照 / 源头脸 / 年龄状态脸的详细写法已经拆为子技能:references/headshot-generation.md。凡写或修订 CH-*FACE、*_源头大头照_3x4.png、*_源头脸部特写_3x4.png、*_状态脸_3x4.png 任务,必须先读取该子技能。
批量人物反同脸规则已经拆为子技能:references/character-appearance-differentiation.md。凡同一文件内有 2 个以上人物脸部任务,或用户指出“同脸 / 长得太像”,必须先读取该子技能,建立角色外貌差异锚点后再写 FACE/STAND prompt。
CH-* 人物图任务,不只检查主角;所有人物脸部特写、立绘、状态图都必须写明确视觉年龄或年龄段。# todo,并在 prompt 中改写该角色自己的正向身份特征、年龄、脸型、眉眼、气质和背景要求。CH-*STAND、*_立绘_.png、*_立绘_1x1.png、*_正背立绘_1x1.png,或 prompt 中出现“正反同框 / 正面与背面左右并列 / 1:1方图”的人物资产任务,必须先读取该子技能。aspect_ratio = "1:1"。成年战马、老年城中人群、青年至中年论师群像、佛像不按真人年龄处理而按古代造像面相。# todo。推荐使用稳定编号:
CH-01:角色 / 状态参考图。ENV-01:环境 / 场景空镜。PROP-01:道具 / 服装 / 物件。STILL-01:由镜头组导出的剧情概念剧照编号;不得使用表示最终成片帧的命名。PAGE-01:漫画页 / 分格页。编号一旦写入文档,后续尽量不要重排;取消时保留条目并标注“取消”。
跨集复用的角色资产应从单集目录抽出,集中放在项目级 人物/ 目录。目录必须浅,不要为同一角色再拆 源头大头照/、立绘/、服装道具/ 等多层;用统一文件名区分类型:
人物/
角色名/
角色名_源头大头照.png
角色名_25岁正式脸.png
角色名_EP01长安法师袍服装图.png
角色名_EP01长安法师袍立绘.png
角色名_EP19重伤状态.png
角色名_源头大头照_不采用.png
规则:
不采用 或 弃用 的图片为废弃/归档素材,任何后续图片都不得以它作为参考图。资产/EPxx/ 下保留场景、道具、概念剧照等本集生产资产;单集图片计划通过相对路径引用项目级 人物/。跨集复用的重要道具应从单集目录抽出,集中放在项目级 道具/ 目录。剧情上同一个道具必须只对应一个主参考图,不能因为进入新集数就重新生成一张外观不同的同名道具:
道具/
锡杖.png
行囊.png
经卷.png
念珠.png
锡杖_损坏状态_EP12.png
行囊_打开状态_EP04.png
经卷_展开状态_EP03.png
规则:
行囊.png,EP02、EP03 等后续计划必须引用同一张图,不得再写 资产/EP02/道具/P02_行囊.png 这类重复生成项。玄奘_行囊.png、商队_货袋.png。道具/、前集 资产/EPxx/道具/ 和已有图片生成计划;发现同一剧情道具已存在时,条目写为“可复用参考图”,不列入“待生成”。1:1 方图,正面与背面左右并列,全身完整不裁切,比例一致。道具/ 中已确认主图,不要在每集重复生成。9:16 或 2:3,不要用正方形;这样能把更多像素用于物体本身,避免主体过小、留白过多或细节糊掉。1:1 方图;横向长物体可用横图 16:9 或 3:2。如果某张图不再生成,不要删除任务。保留对应 [[tasks]],将 target_image_path 行尾标为 # cancel,并用 TOML comments 写明原因和替代处理。不要使用 TOML 小标题或列表。
# cancel_reason: 该角色只作为伏笔存在,当前章节不提前给出明确形象。
# cancel_handling: 后续概念剧照只用环境、声音、角色反应或不可辨认剪影暗示。
[[tasks]]
id = "CH-05"
target_image_path = "资产/人物/某角色/某角色_源头脸部特写_3x4.png" # cancel
reference_image_paths = []
aspect_ratio = "3:4"
prompt = """【基础美术】...
【具体内容】...
【生成要求】..."""
图片生成计划/ 一层批次文件结构:1.toml、2.toml、3.toml……,没有 00_制作顺序/、01_主人物/、02_配角/、03_环境/、04_服装道具/、05_分集/ 等计划子目录。[[tasks]] 的自然顺序就是本批次生成顺序,不再额外维护制作顺序索引。道具/、前集道具和旧图片计划,避免为同一剧情道具跨集重复生成。道具/ 目录,并由每集图片计划引用,而不是复制到每集 资产/EPxx/道具/。9:16 或 2:3,而不是默认方图。画面地点为“地点A、地点B、地点C” 让模型混合空间,必要时拆成 STILL-xxA / STILL-xxB。【基础美术风格】、【具体生成内容】 和必要的 【生成要求】。