| name | asset-development |
| description | Scope reusable production assets and define stable visible designs from an exact source text. |
资产范围与视觉设计
作用
从精确源文本(剧本、商业脚本或其他脚本)、用户要求、参考素材和已采纳的 Creative Direction 中筛选值得制作的可复用角色、场景、道具,完成稳定可见设计,并把每张资产的唯一最终图片 Prompt 与显式生成参数写入最终结构化批次。主 Agent 是该资产专业结果的唯一 writer,并把同一批次直接交给媒体 Operation。
资产筛选
- 资产必须同时通过三个门槛:在画面中真实出现或承载可见动作;其身份/空间结构需要跨镜头保持一致或被后续生成独立引用;不能被另一已选资产完整代表而不丢失关键视觉连续性。仅“被看见”本身不够。
- 只在对白、旁白或背景设定中提及而没有画面呈现的实体不登记;瞬时背景物、无身份群众、普通装饰和不影响连续性的偶发物不登记。
- 没有任何实体通过全部门槛时使用
decision: "no_assets"、空 items,并在 overview 解释原因;不得为了让清单非空而虚构或升级多余资产,也不得提交这份无任务清单。
- 同一实体的机位、景别、构图、光线或短暂动作变化不能成为新资产。只有独立且持久的视觉身份才拆分。
- 同一叙事地点中视觉结构明显不同、各自真实承载画面动作且后续需要独立参考的空间必须拆分,例如山顶与坠落后的崖底;仅转场一闪而过、没有动作落点或无需独立视觉连续性的空间不拆分。
- 通过筛选的资产中,主角级且风格空间大的视觉身份——换一种设计方向就会改变整部作品观感的核心角色、标志性生物、核心产品或核心形象——其设计方向属于可对齐决策,在批次冻结前交由主 Agent 按其对齐契约处理;配角、功能性资产以及方向已由源文本、用户输入或 Creative Direction 确定的资产不触发对齐。
- 商业内容中的产品、包装或品牌物按道具处理;用户提供的精确 Logo、包装图是参考来源,只能作为身份与结构参考,不得重绘后冒充权威品牌资产。
- 同一个专业结果完成筛选、稳定身份设计与最终 Prompt;不输出第二套候选状态或再拼接另一版 Prompt。
- 可复用视觉资产只有三种:
character、location、prop。不得发明 style-board、mood-board、visual-style、预览图或泛化参考图作为可复用资产类型;风格由 Creative Direction 的文本承载,不由图片资产承载。
canonicalName + assetKind 表达稳定创作身份;不得发明系统 ID、使用数组位置或新增含糊的 other 类型。实际媒体身份由输出 WorkspaceResource 路径与 resourceId 拥有。
- 资产是基础身份设计,不是任意时刻的状态快照。剧情产生持续的新状态(重伤、换装、剃发、损毁)且后续生成需要独立引用时,创建新版本或新资产表达新状态,不改写原资产的既有解释。
风格消费边界
- Creative Direction 非空时使用完整已采纳方向,自行判断哪些政策影响资产筛选、身份设计和最终呈现。
stableDescription 仍只记录资产自身可见且可复用的身份、外观、材质和结构;画幅、版式、背景和生成要求只进入最终 Prompt 与批次参数,不污染身份事实。
- 最终 Prompt 必须自行合并稳定设计、项目视觉风格和本 Skill 的资产图版式。提交阶段与服务端都不会追加、改写或补全创作指令。
stableDescription 使用与用户内容一致的语言:中文内容写中文,英文内容写英文。
- 角色稳定身份描述不混入艺术风格、滤镜、光影、背景或构图。
- 场景基础描述保存真实空间结构、材质与物理光源条件;最终 Prompt 再合成项目风格与场景资产图格式。
- 视频使用跨媒体总体风格,不应继承资产图专用灯光或材质处理。
- 用户或项目风格高于参考图画风。参考图用于身份与结构,不能覆盖明确指定的美术风格;忽略原图偶然色调、光线、模糊、噪点和瑕疵。
角色设计
人类角色的可见信息
- 明确性别呈现和具体年龄感。
- 描述脸型、可见五官特征、眼睛形状与大小,以及眼睛颜色。
- 描述头发颜色、长度、发型与发质。
- 描述身高感、体态、肩宽、腰线和整体轮廓。
- 描述肤色、肤质和可见标记,如粗糙、光滑、雀斑、胎记、疤痕或纹身。肤色与发色、瞳色一样是跨镜头身份锚点,用中性、具体的描述写清;不写就会被生成模型每次随机化。
- 服装写清款式、年代、材质、配色、结构和细节;鞋子是完整人物设计的必要部分,必须写款式、材质和颜色。
- 只添加能加强身份和复用性的可穿戴配饰,例如眼镜、耳饰、项链、手表或戒指。
- 服装、发型、鞋履和配饰必须符合故事年代与社会背景。
非人类角色
- 动物、神话生物、非人形生物或明确的风格化形象不强套人类外貌模板。
- 描述从角色名或物种名开始,围绕形态、轮廓、表面、关键器官、服饰和核心辨识特征展开。
- 修改时保留其身份锚点,只改变用户明确要求的部分。
角色描述纪律
- 角色资产描述只写稳定外貌,不写表情、姿态、动作、背景、环境、手持剧情道具或故事性句子。
- 不用“或”“可能”“也许”“大概”等不确定词;每个视觉选择明确具体。
- 不写“气场强大”“成熟稳重的气息”等无法直接看见的抽象气质。若需要表达身份能量,应转译为可见轮廓、服装、材质和配饰。
- 以原文明确外貌为最高优先级。
- 在不过度锁死的前提下保留合理生成空间。除非输入要求,不规定每根发丝、每个色块或每件配饰。
参考角色图
- 从参考图提取脸部结构、发型、体型、服装结构和可穿戴配饰等稳定身份特征。
- 参考图只展示局部身体时,根据可见服装与角色身份合理补齐下装、鞋履、手臂和手部;补全部分必须与已见部分协调。
- 图像反推按画面实际可见情况写肤色和眼睛颜色,但仍不得描述表情、动作、背景和姿势。
- 反推分析可以给出由画面直接支持的整体造型或气质关键词,帮助理解身份方向;进入最终生图描述时,必须把这些关键词转译成可见的轮廓、服装、材质和配饰,不能留下无法视觉化的抽象判断。
场景设计
- 从明确的场景名称或空间身份开始,把泛称具体化为稳定可控的真实空间,而不是停留在“教室”“办公室”等标签。
- 忠实保留用户指定的核心场景身份、关键物体、材质、时代感和空间关系,不能替换为更熟悉但无关的场景类型。
- 写清建筑与空间结构:墙、地面、天花、门窗、边界、开口、尺度和纵深。
- 材质、颜色和表面状态具体可见;加入有叙事价值的使用痕迹、生活痕迹与陈设,避免泛化美术词。
- 明确前景、中景、背景或近处、中部、远处的层次,保持完整全景和可理解的空间边界,不生成局部裁切或含糊背景。
- 设置至少三个稳定、清晰可见的空间锚点,并在其周边保留可用地面或空白区域,供后续人物落位;这只是隐形构图指导,不能画标签、轮廓框、箭头、引导线或人工占位。
- 场景稳定描述中的光线只记录真实来源、位置、时间和对空间的物理影响;不写由执行层统一合成的戏剧化光影效果。
- 私密空间或明确空镜不加入人物。宴会厅、集市、上课教室等天然有人群的场景可以加入模糊、无身份的人群,不能引入有名主角或剧情动作。
- 场景资产应是可复用的环境建立画面,不是某个瞬间的叙事分镜。不要出现对白、字幕、解释文字、水印、标注、箭头或 Logo。
- 场景世界中自然存在的招牌、路标、门牌、海报、包装或屏幕文字只有在属于环境时保留,并保持次要自然,避免随机乱码和漂浮文字。
道具设计
- 只描述道具本体的静态视觉信息:主体结构、轮廓、数量关系、材质、颜色、表面处理、纹样、装饰和磨损。
- 不写用途、剧情、角色动作、人物、手部、桌面、房间、背景、镜头或氛围光影。
- 结果适合白底居中、主体完整清楚的独立道具资产图。
- 参考图可提供轮廓、结构、材质、纹样与配色,但不能引入参考图中的偶然背景或人物。
最终资产生成批次
- 每个资产图片 item 必须写完整最终 Prompt;执行层会逐字冻结,不能依赖其他字段或服务端再次补写。
- 图片模型由设置固定,不填写
model;按当前 create_image 工具 schema 的 options 填写未固定参数。固定分辨率、质量由服务端取配置,不在 item 中重复填写;工具没有 options 时省略它。
- 角色:一张 4:3 横向图,左右等分;左侧同一角色脸部特写,右侧同一角色无遮挡全身;纯白背景;不得出现其他人物、道具或环境。
- 场景:一张 4:3 横向图,正前方完整展示整个空间,不拆多视图;不得出现人物、松散家具或独立道具;场景固定结构可保留。
- 道具:一张 4:3 横向图,只出现一个居中、完整、方向明确、无遮挡的道具;纯白背景;不得出现人物、其他道具或环境。
- 不输出
aspectRatio。可复用资产的 4:3 画幅由服务端资产策略唯一决定,不在专业交接中重复提交。
assetKind 与 schemaId 必须严格对应:character → project.character_image、location → project.location_image、prop → project.prop_image。
- 唯一专业结果是运行时注入 schema 约束的
outputKind: "asset_generation_batch" 严格 JSON。该机器 Schema 是字段、必填项和层级的唯一权威;本 Skill 不另写文件或第二份模板。references 只使用精确的 ready Resource 身份与版本。
overview、canonicalName、aliases、stableDescription、consumedByShots 都是同一正式 JSON 的规定字段,不得写进旁边的 Markdown,也不得发明 Schema 之外的设计说明字段。
生成后评审检查点
本 Skill 声明一个硬对齐检查点:生成资产评审。时机在全部新生成的前置视觉资产就绪之后、任何依赖它们的语音或视频工作开始之前。做法:检查确切的 ready Resource,概述它们的身份与可见质量结果,然后由主 Agent 发起一张卡询问用户是否满意。选项顺序固定:“满意并继续”在前,“先暂停,不进入下游生产”其次,并提供本地化的 otherLabel 邀请用户写出具体修改要求。在用户接受、或所要求的资产修改就绪并再次评审之前,不得提交依赖它们的生产。复用已存在的资产不触发本检查点。
自检
- 正式生成批次是否只包含从输入源文本判断值得复用的生产资产?注入完整 Creative Direction 时,是否使用了所有相关政策且没有把无关领域变成资产事实?
- 是否同时保留纯净的稳定设计,并把完整最终 Prompt 与正确版式写入批次,同时把 4:3 画幅唯一交给服务端资产策略?
- 角色是否稳定、完整、年代一致、鞋履明确,肤色/发色/瞳色等身份锚点是否写清,并排除了动作、背景、不确定词和抽象气质?
- 非人类角色是否按真实形态处理而非套用人类模板?
- 场景是否忠实、结构完整、层次清楚、锚点稳定,并留有无标记的落位空间?
- 道具是否只包含静态本体信息?
边界
本 Skill 负责资产筛选、稳定可见设计、最终资产图片 Prompt 和对应批次参数。项目级呈现政策来自已提供的 Creative Direction;模型由系统配置决定,主 Agent 只按当前 create_image 工具 schema 填写创作参数;主 Agent 把同一结果的原样 items 提交给 create_image,媒体执行、能力校验、计费、审批、Task 与终态由系统服务负责。