원클릭으로
image-generation-plan
通用图片生成计划技能。用于把故事、剧本、镜头组、制作包或已有资产整理成逐张生成图片的 TOML 计划,明确生成顺序、保存路径、参考图、画幅和提示词;默认只写计划,不提交生成任务。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
通用图片生成计划技能。用于把故事、剧本、镜头组、制作包或已有资产整理成逐张生成图片的 TOML 计划,明确生成顺序、保存路径、参考图、画幅和提示词;默认只写计划,不提交生成任务。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
Create Chinese video cover images and thumbnails from a reference image, especially for AI/tech tutorial covers requiring exact Chinese title text, soft-light 3D-rendered portrait aesthetics, and exact 16:9, 4:3, and 3:4 aspect ratios. Use when the user asks to make, redo, or adjust cover images/thumbnails with a supplied reference image and Chinese text. Treat 3:4 as a strict ratio that must never be substituted with 2:3.
Codex/ChatGPT 专用的纯美术风格获取、提取、萃取、蒸馏和迭代技能。用户说 get style、distill style、extract style、style extraction、style distillation、获取风格、提取风格、萃取画风、反推风格等任何中英文类似意图时触发完整 pipeline:先判定参考图媒介大类(纯2D、纯3D渲染、2.5D、2D+3D混合、真实摄影),再真实生成候选图、读图对比、自我修正,至少完成2轮4类验证图迭代,并独立并发生成16张材质/纹理锚点图,最终产出可复用的新风格 skill 文件夹。禁止只输出提示词或只生成 prompt 文件。
通用 AI 图片质量闸门。用于在接受图片、作为后续参考、进入风格验证或交付前,检查文件可读性、任务 prompt/简报符合度、主体与身份、解剖和物理逻辑、参考图用途、构图可读性与通用生成伪影。适用于角色图、环境图、道具图、概念图、漫画页、风格测试图和批量图片计划。不负责判定候选图是否忠实匹配目标画风;风格匹配使用 validate-style-match。
图片美术指导 / 视觉质检技能。用于选择或审查参考图、判断候选图是否适合进入项目参考链路、复核生成图的内容/画质/风格一致性,并输出“可用 / 只作气氛参考 / 不可用”的明确结论。不要替代 image-generation-plan 的 TOML 编排,也不要替代 style-distill 的风格萃取迭代。
通用影视、短剧、动画、漫画和 AI 内容制作流水线。用于从故事梗概、零散设定或分集大纲出发,整理剧本、镜头组、资产清单、角色/场景/道具需求、图片计划和关键帧生产顺序,并用阶段门禁保证连续性与可执行性。
将剧本、故事梗概、口播稿、小说段落、广告脚本、短视频文案或零散剧情描述转化为面向 AI 图片、视频和漫画生成的 Markdown 镜头组文档。强调先按叙事任务整理镜头组,再在组内保留少量必要镜头节拍;单一分镜表只作为辅助,不作为默认核心产物。
SOC 직업 분류 기준
| name | image-generation-plan |
| description | 通用图片生成计划技能。用于把故事、剧本、镜头组、制作包或已有资产整理成逐张生成图片的 TOML 计划,明确生成顺序、保存路径、参考图、画幅和提示词;默认只写计划,不提交生成任务。 |
| version | 1.0.0 |
| author | Hermes Agent |
| license | MIT |
| metadata | {"hermes":{"tags":["image-generation","production-plan","toml","prompts","creative-assets"],"related_skills":["creative-production-pipeline","image-art-direction","character-reference-pipeline"]}} |
当需要把故事、剧本、镜头组、制作包、漫画章节或已有资产,整理成一份“后续逐张生成图片”的 TOML 计划文件时,使用本技能。
本技能只规定 TOML 计划文件的格式、写法、信息完整度和约束纪律,不绑定任何具体项目画风。
只写计划,不生成图片
图片生成计划必须等镜头组之后再做
计划服从源文档
镜头组是概念剧照来源,不是单镜头表
角色和道具中心管理,先复用后新增
人物/<角色名>/ 下,不跟随单集目录反复生成;同一角色的图片直接放在同一个角色文件夹内,不再按 源头大头照/、立绘/ 等拆多层。道具/ 目录;如果剧情上是同一个道具(如锡杖、行囊、经卷、念珠、书箱、马鞍等),只能生成一张主参考图,后续各集只引用它,不要在每集 资产/EPxx/道具/ 下重复生成同名道具。人物/、道具/、前集资产索引和已生成图片;能复用的角色/道具先复用,只有剧情明确出现新道具、道具外观永久变化、损坏/打开/特殊状态需要单独表现时,才新增道具图。跨集角色只定一次源头脸
# todo 重新生成。路径、参考图、提示词必须可执行
约束写在计划里,不靠记忆执行
长篇计划默认用一层批次 TOML,不按资产类型拆计划目录
图片生成计划/ 目录默认保持一层:1.toml、2.toml、3.toml……;每个 TOML 对应一个分集 / 批次。[[tasks]] 的自然顺序就是本批次生成顺序。不要再额外维护 00_制作顺序/、制作顺序.md 或任务索引文档。01_主人物/、02_配角/、03_环境/、04_服装道具/、05_分集/。这些是资产分类思路,不是生成计划组织方式。target_image_path 仍可指向 资产/人物/、资产/道具/、资产/EPxx/场景/、资产/EPxx/概念剧照/ 等解耦保存路径。target_image_path 仍指向 资产/ 下的正确解耦路径。输出必须是 .toml 文件,不输出 TOML 计划正文,不使用 TOML 标题、引用块、勾选清单或单张图片条目模板。所有需要写给 agent 看的额外说明,写成 TOML comments:
# 《项目 / 集数 / 章节》图片生成计划
# 依据:镜头组_42集版/EPxx_xxx_镜头组.md;对应剧本:剧本_42集版/EPxx_xxx.md。
# agent执行规则:本计划用于agent模型生成图片;每一次生成时,传给agent的 prompt、reference_image_paths、aspect_ratio 和其他参数,必须严格遵照当前单独的 [[tasks]]。
# 任务顺序:每个计划文件内严格按 1) ENV/environment,2) objects/tools/props/clothes/costumes,3) CH/characters/roles,4) STILL/conceptual scene shots 排序。
[[tasks]]
id = "ENV-01"
target_image_path = "资产/EPxx/场景/S01_主空间.png" # todo
reference_image_paths = []
aspect_ratio = "16:9"
prompt = """..."""
TOML comments 的用途:记录源文档、范围、全局执行规则、生成顺序、重要资产约束和自检提示。Comments 只能辅助执行,不能替代任何单个 [[tasks]] 的字段;每个任务仍必须 self-contained。
必须用 # comments 说明:
必须用 # comments 说明:
base-art-style.md、base-style.md、art references/base-art-style.md),该文件就是基础画风的硬约束:提示词里的基础美术行必须逐字采用该文件内容或明确引用该文件,不得写近似改写版;提示词其他部分也不得加入与该文件媒介、渲染、材质、光影、色彩、对比度或细节密度相冲突的词语。# todo。通用提示词公式:
【基础美术风格】<电影项目只写硬摄影规格:摄影机型号、记录格式、镜头品牌/系列/焦段、T 值、画幅比例;保持为摄影部门语言>
【具体生成内容】<写主体、动作、地点、道具、状态、人数、构图目的>
【生成要求】<用正向语言写清本图必须满足的构图、身份、时代、画幅、背景、材质和参考图约束>
注意:
【基础美术风格】 不应混入具体人物、剧情、道具或项目专属设定。【基础美术风格】 应采用摄影部门语言,而不是抽象美术口号。必须明确摄影机和镜头型号,例如 ARRI ALEXA 35 + Cooke Anamorphic/i 40mm、Sony VENICE 2 + Panavision Primo 50mm 等;具体型号应服从项目统一摄影方案。【基础美术风格】 只放摄影机、记录格式、镜头系列/焦段、T 值、画幅比例等硬规格;不要写“安全构图、固定机位、光源依据、背景只交代空间、不使用现代柔光箱效果”等调度/说明文字,这些如必须出现,应放入具体生成内容且保持简短。【提示词】 内不能写 对应镜头组 EPxx-SGxx、本图只选择、如上文、本集、镜头组限定 等依赖外部文档的描述;每条提示词必须直接说明地点、人物、动作、道具、画面边界和禁项。电影感写实历史纪录片风格,唐代与西域佛教题材,克制构图,真实材质,低饱和暖冷对比,自然尘埃与体积光,空间真实可行,细节清晰但不过度堆砌,无文字无水印。 其中“真实材质、低饱和暖冷对比、自然尘埃与体积光、空间真实可行、细节清晰但不过度堆砌”等属于文学化/说明书化描述,应删掉或转化为具体摄影、灯光、镜头和场面调度信息。【具体生成内容】 承担主体、动作、地点和剧情信息;必须短句化、可直接投喂,不写制作备注或索引说明。概念剧照、画面表现、剧情说明、台词、长段故事前因后果,尤其不要把一段镜头组正文直接塞进提示词。图1用于场景空间和动线,图2用于玄奘身份与服装,图3用于麹文泰身份与服装 这类用途,并补充本张图特有的站位、表情、动作、景别变化。reference_image_paths 完全相同,说明环境相同、主要人物相同;除非两张图的动作、事件、人物关系、景别或镜头角度非常不一样,否则不要写第二条,应合并成一条或删掉后者。只靠不同对白、不同剧情说明、轻微表情变化,不能成立为第二张图。【生成要求】、negative prompt 或“不要/不得/禁止”句式里。改用正向约束,例如“纯白背景、单人正面头肩像、只呈现本任务角色、画面干净”。
-agent没有项目上下文。每个 [[tasks]] 的 prompt 必须 self-contained:直接写出画面里出现的主体、地点、动作、人数、道具、构图、光线、情绪和画面边界;不写“服务《某集》”“本段叙事”“源文档限定”“按画面需要”等依赖外部理解的句子。reference_image_paths 必须完整,并在 prompt 中用 图1、图2 的方式说明每张参考图的用途。不要在 prompt 里重复叙述参考图已经包含的细节,只写“图1用于空间结构 / 图2用于人物身份 / 图3用于道具形制”等用途。styled 前缀或后缀的版本;例如同时有 ballroom_16x9_styled 和 ballroom_16x9 时,优先选 ballroom_16x9_styled。没有 styled 版本时才使用普通版本。必须用 # comments 说明:
长篇 / 多集项目的图片生成计划应按分集批次组织成一层 TOML 文件,而不是按最终资产目录机械拆分。推荐结构:
图片生成计划/
README.md
1.toml
2.toml
3.toml
...
规则:
1.toml → 2.toml → 3.toml……;不要再写 00_制作顺序/、制作顺序.md 或单独索引文档。[[tasks]] 出现顺序生成;因此每个计划文件必须严格按 1) ENV/environment,2) objects/tools/props/clothes/costumes,3) CH/characters/roles,4) STILL/conceptual scene shots 排序。不要根据最终保存目录重排,也不要把 characters 放到 clothes/props/tools 之前。图片生成计划/ 拆成 01_主人物/、02_配角/、03_环境/、04_服装道具/、05_分集/。这些会让执行顺序和保存目录混在一起,增加维护成本。target_image_path 可以且应该按最终资产库组织:人物放 资产/人物/,道具放 资产/道具/,分集场景放 资产/EPxx/场景/,分集概念剧照放 资产/EPxx/概念剧照/。1.toml;如果人物 B 第一次在 EP04 登场,则归入 4.toml。但在任何一个文件内部,仍必须先写环境,再写 objects/tools/props/clothes/costumes,再写 characters/roles,最后写 conceptual scene shots。资产/道具/;后续批次只引用它。跨集角色源头脸、状态脸和立绘集中保存到 资产/人物/<角色名>/。N.toml 内的 [[tasks]] 自然顺序中;服装/衣物属于第 2 类,必须排在人物前;概念剧照必须最后。这种规则模拟实拍制片流程:按拍摄 / 剧情推进批次落实场地、服化道和演员状态;但资产保存仍保持制片资产库结构,便于跨集复用。
当用户要求“对照剧本 / 镜头组删除从来没有登场的内容”时,必须先做源文档盘点,再改 TOML;不要凭角色名直觉删除。
流程:
剧本_* 和 镜头组_* 目录内所有相关 .md,合并为可检索文本。N.toml,提取 id、target_image_path、reference_image_paths、prompt,并从 资产/人物/<角色名>/、资产/道具/<道具名>.png、任务 id 中抽取实体名。[[tasks]];如果它是后续任务参考图,先判断后续任务是否也应删除或改引用。id、target_image_path、reference_image_paths、prompt 内角色称呼和相关 资产/人物/<角色名>/ 路径,避免旧称呼残留。当用户指定使用 TOML 计划时,输出文件使用 图片生成计划.toml 或带集数/版本的同类文件名,根结构为任务数组:
TOML 文件开头必须写明agent执行规则:本计划用于agent模型生成图片;每一次生成时,传给agent的提示词、参考图和其他参数,一定要严格遵照当前单独的 [[tasks]],不能根据上下文、相邻任务、既有图片或角色印象自行修改、补全、串用参考图或沿用其他任务的人脸。
TOML 的 prompt 必须只使用正向提示词,不写 negative prompt;不要用“不要、不得、禁止、避免、不能、不可、无、没有”等方式列出排除项,也不要在负面句里提到不想出现的对象。把排除意图改写为正向画面约束。
每个 TOML 任务都必须独立可执行:参考图列表完整,prompt 说明 exact 画面内容;如果引用参考图,按 图1、图2 标注用途。生成计划不能假设agent知道剧本、镜头组、上下文或前后任务。
[[tasks]]
id = "CH-少年玄奘-FACE"
target_image_path = "资产/人物/少年玄奘/少年玄奘_源头脸部特写_3x4.png" # todo
reference_image_paths = []
aspect_ratio = "3:4"
prompt = """【基础美术】ARRI ALEXA 35,Open Gate 4.6K,Cooke Anamorphic/i 40mm,T2.8,2.39:1
【具体内容】少年玄奘源头脸部特写,视觉年龄8岁左右的男童,正面头肩像,干净中性背景,五官清晰,神情聪敏、恭敬、认真到近乎执拗,唐代士族儿童衣冠气质,作为后续同一张脸的身份锚点。
【生成要求】纯白背景,单人正面头肩像,身份清晰,画面干净,服饰和时代质感服从本任务"""
TOML 任务类型等价于:
type ImageGenerationTask = {
id: string
target_image_path: string // 若图片暂时不存在,行尾注释 # todo;若已存在且本轮未改提示词,行尾注释 # done;若本轮修改了该任务提示词或参考图,即使图片文件已存在,也必须改为 # todo
reference_image_paths: string[]
aspect_ratio: string // 建议画幅,如 "3:4"、"2:3"、"1:1"、"16:9"、"9:16";必须服务图片类型与主体形状
prompt: string // [基础美术]+[具体内容]+[生成要求];禁止使用 negative prompt
}
type ImageGenerationPlan = ImageGenerationTask[]
当前项目默认图片资产目录:
资产/
人物/
角色名字/
角色名_源头脸部特写_3x4.png
角色名_立绘_.png
道具/
道具名.png
EP1/
场景/
场景名.png
概念剧照/
名.png
路径写法要求:
target_image_path 和 reference_image_paths 使用相对路径,不使用绝对路径。aspect_ratio 是必填字段;角色脸部特写通常用 3:4;单人单面全身立绘可用 2:3;正反同框立绘必须用 1:1;细长竖向道具优先 9:16 或 2:3;环境与概念剧照常用 16:9,具体以主体形状和后续用途为准。资产/人物/<角色名字>/;道具统一放入 资产/道具/;分集场景与概念剧照放入对应 资产/EPxx/场景/、资产/EPxx/概念剧照/。# done 表示现有图片可以继续沿用;# todo 表示需要重新生成或首次生成。prompt、reference_image_paths、身份年龄或关键约束,该任务必须标为 # todo,不能因为目标图片文件已经存在而保留 # done。脸部大头照 / 源头脸 / 年龄状态脸的详细写法已经拆为子技能:references/headshot-generation.md。凡写或修订 CH-*FACE、*_源头大头照_3x4.png、*_源头脸部特写_3x4.png、*_状态脸_3x4.png 任务,必须先读取该子技能。
批量人物反同脸规则已经拆为子技能:references/character-appearance-differentiation.md。凡同一文件内有 2 个以上人物脸部任务,或用户指出“同脸 / 长得太像”,必须先读取该子技能,建立角色外貌差异锚点后再写 FACE/STAND prompt。
CH-* 人物图任务,不只检查主角;所有人物脸部特写、立绘、状态图都必须写明确视觉年龄或年龄段。# todo,并在 prompt 中改写该角色自己的正向身份特征、年龄、脸型、眉眼、气质和背景要求。CH-*STAND、*_立绘_.png、*_立绘_1x1.png、*_正背立绘_1x1.png,或 prompt 中出现“正反同框 / 正面与背面左右并列 / 1:1方图”的人物资产任务,必须先读取该子技能。aspect_ratio = "1:1"。成年战马、老年城中人群、青年至中年论师群像、佛像不按真人年龄处理而按古代造像面相。# todo。推荐使用稳定编号:
CH-01:角色 / 状态参考图。ENV-01:环境 / 场景空镜。PROP-01:道具 / 服装 / 物件。STILL-01:由镜头组导出的剧情概念剧照编号;不得使用表示最终成片帧的命名。PAGE-01:漫画页 / 分格页。编号一旦写入文档,后续尽量不要重排;取消时保留条目并标注“取消”。
跨集复用的角色资产应从单集目录抽出,集中放在项目级 人物/ 目录。目录必须浅,不要为同一角色再拆 源头大头照/、立绘/、服装道具/ 等多层;用统一文件名区分类型:
人物/
角色名/
角色名_源头大头照.png
角色名_25岁正式脸.png
角色名_EP01长安法师袍服装图.png
角色名_EP01长安法师袍立绘.png
角色名_EP19重伤状态.png
角色名_源头大头照_不采用.png
规则:
不采用 或 弃用 的图片为废弃/归档素材,任何后续图片都不得以它作为参考图。资产/EPxx/ 下保留场景、道具、概念剧照等本集生产资产;单集图片计划通过相对路径引用项目级 人物/。跨集复用的重要道具应从单集目录抽出,集中放在项目级 道具/ 目录。剧情上同一个道具必须只对应一个主参考图,不能因为进入新集数就重新生成一张外观不同的同名道具:
道具/
锡杖.png
行囊.png
经卷.png
念珠.png
锡杖_损坏状态_EP12.png
行囊_打开状态_EP04.png
经卷_展开状态_EP03.png
规则:
行囊.png,EP02、EP03 等后续计划必须引用同一张图,不得再写 资产/EP02/道具/P02_行囊.png 这类重复生成项。玄奘_行囊.png、商队_货袋.png。道具/、前集 资产/EPxx/道具/ 和已有图片生成计划;发现同一剧情道具已存在时,条目写为“可复用参考图”,不列入“待生成”。1:1 方图,正面与背面左右并列,全身完整不裁切,比例一致。道具/ 中已确认主图,不要在每集重复生成。9:16 或 2:3,不要用正方形;这样能把更多像素用于物体本身,避免主体过小、留白过多或细节糊掉。1:1 方图;横向长物体可用横图 16:9 或 3:2。如果某张图不再生成,不要删除任务。保留对应 [[tasks]],将 target_image_path 行尾标为 # cancel,并用 TOML comments 写明原因和替代处理。不要使用 TOML 小标题或列表。
# cancel_reason: 该角色只作为伏笔存在,当前章节不提前给出明确形象。
# cancel_handling: 后续概念剧照只用环境、声音、角色反应或不可辨认剪影暗示。
[[tasks]]
id = "CH-05"
target_image_path = "资产/人物/某角色/某角色_源头脸部特写_3x4.png" # cancel
reference_image_paths = []
aspect_ratio = "3:4"
prompt = """【基础美术】...
【具体内容】...
【生成要求】..."""
图片生成计划/ 一层批次文件结构:1.toml、2.toml、3.toml……,没有 00_制作顺序/、01_主人物/、02_配角/、03_环境/、04_服装道具/、05_分集/ 等计划子目录。[[tasks]] 的自然顺序就是本批次生成顺序,不再额外维护制作顺序索引。道具/、前集道具和旧图片计划,避免为同一剧情道具跨集重复生成。道具/ 目录,并由每集图片计划引用,而不是复制到每集 资产/EPxx/道具/。9:16 或 2:3,而不是默认方图。画面地点为“地点A、地点B、地点C” 让模型混合空间,必要时拆成 STILL-xxA / STILL-xxB。【基础美术风格】、【具体生成内容】 和必要的 【生成要求】。