| name | visual-identity-expander |
| description | 把用户上传的 Logo、人物头像、个人形象、IP 角色、插画、产品照片或标志性物件,扩展成一套统一的视觉身份提示词。用户提到一张图做品牌全案、个人品牌视觉、头像延展、IP 设定、品牌主视觉、包装周边、社交媒体视觉,或要求保持参考图一致性生成多场景图片时使用。默认输出视觉 DNA 卡和一组可直接生图的完整提示词;有生图工具且用户明确要求时可继续生成图片。 |
Visual Identity Expander(视觉身份延展)
把一张核心参考图扩展成一套视觉语言统一、可以继续迭代的视觉身份方案。
核心原则:先锁定可识别的视觉基因,再扩展使用场景。每张图可以变化,但必须让人看出它们属于同一个人、角色、品牌或产品。
交付物先定:图,还是提示词
这决定身份怎么锚定,先问清楚再往下走。
- 交付提示词(默认):身份必须文字化——把参考图的特征写成自足的英文视觉描述。提示词里不能靠"参考上传的图"活着,否则离开这次会话就是废纸。
- 交付图:参考图在生成上下文里,可以额外挂图锚点
Image 1: identity reference,保真度更高。
默认双锚:文字锚点写满,有图时再附一行图锚点。同一条提示词带图时保真,脱离图仍能降级使用。规则见 references/prompt-contract.md。
人物类要如实说边界:文字锁得住发型、眼镜、服装、气质和镜头习惯,锁不住同一张脸。纯提示词交付时在输出顶部写明这一条。
Read
- 提取和判断视觉基因:读
references/visual-dna.md。
- 编译提示词:读
references/prompt-contract.md(双锚 + 七槽 + 成组基座)。
- 选交付物形态、决定出几条:读
references/deliverables.md。
- 需要完整走查示例时再读
references/examples.md。
底层写法规则继承 gpt-image-prompt-spec 的七槽与五条硬规则,本 skill 不重复定义,只做身份延展这一层的补充。
Input
优先从用户输入和上传图片推断,不强制填表:
- 视觉母体:Logo、人物头像、个人形象、IP、插画、产品或物件。
- 名称与文字:品牌名、人名、账号名、口号;没有就不编造。
- 用途:个人品牌、商业品牌、内容账号、产品宣传、活动或作品集。
- 气质:从参考图推断;用户明确指定时,以用户要求为准。
- 画幅:按平台和用途决定;用户指定比例时严格遵循。
只有缺失信息会显著改变结果时才提问。其他内容直接做合理假设,并在输出顶部简短说明。
Workflow
- 定交付物:出图还是出提示词,决定锚点策略。
- 识别输入类型:Logo、人物/头像、IP/插画、产品/物件,或多种输入组合。
- 提取视觉 DNA:拆成不可变特征与可变特征,每项写成可编译的视觉事实——遮住原图念一遍,没见过原图的人要能画出来。手法固化为身份,参考图里的内容决策该换掉。
- 建立系统规则:主辅色(给色值)、形状语言、材质、光线、排版、镜头和情绪。
- 定规模:查
deliverables.md 的裁剪表,按用户实际要的东西定条数,不硬凑五条。完整套装是——主视觉 / 识别系统板 / 变化系统 / 应用系统 / 传播场景。
- 编译提示词:每条按七槽输出,完整独立可直接使用。成组基座(identity lock、色板材质、身份纪律)逐字重复写进每一条,不留未决选项、斜杠菜单或空白占位符。
- 一致性检查:逐条核对身份、轮廓、颜色、材质、文字和视觉气质有没有漂移;基座措辞出现分叉就回去统一。
- 按需生图:环境提供图像生成工具且用户明确要求时,逐张生成;否则只交付提示词。
Adaptive Routing
- Logo:保留几何比例、负空间、字标关系和品牌色;变化系统改为辅助图形、纹样与 Logo 变化,不默认生成人物 IP。
- 人物头像/个人形象:保留脸部身份、发型、眼镜、标志服装和气质;变化系统生成动作与表情。
- IP/插画角色:保留轮廓、五官比例、配色和标志性道具;变化系统生成角色设定与姿态表。
- 产品/物件:保留外形、材质、结构和品牌标记;变化系统生成视角、细节与主题变化。
- 多张参考图:先区分主参考与辅助参考。主参考锁身份,辅助参考只提供风格、材质或场景,不混合成新身份。
Output Format
## 输入判断
- 输入类型:
- 交付物:提示词 / 图
- 锚点策略:双锚 / 纯文字 / 带图
- 使用目标:
- 必须保留:
- 可以变化:
- 本次假设:
## 视觉 DNA
- 核心轮廓:
- 主辅色(带色值):
- 字体与图形语言:
- 材质与光线:
- 气质关键词:
## 01 主视觉
```text
完整提示词
```
(按定好的规模继续 02–05,格式相同)
## 一致性检查
- 身份:通过/需修正
- 轮廓:通过/需修正
- 色彩:通过/需修正
- 文字:通过/需修正
- 气质:通过/需修正
Quality Gates
- 每条提示词必须能独立使用,不依赖"同上"或前文省略信息。
- 成组基座逐字重复:identity lock、色板材质、身份纪律三段在每条里一字不差。措辞分叉即编译错误。
- 不靠"参考上传图"承载身份——交付物是提示词时,身份必须已经文字化到自足。
- 排除项写进 Constraints 正文,不输出独立
Negative prompt: 块。
- 不用 masterpiece / 8k / ultra detailed 这类水词,换成视觉事实。
- 不把"画得好看"当成一致性;先检查身份和系统规则,再检查美感。
- 不为 Logo、包装或服装编造无法确认的文字。需要准确文字时明确写出用户提供的原文,并加
render all text verbatim。
- 色值给不准时给色族加倾向,不瞎编十六进制。
- 人物延展不随意改变脸型、年龄、族裔、发型和标志性配饰。
- IP 延展不随意改变轮廓、五官比例、配色和标志性道具。
- 产品延展不随意改变结构、接口、标签层级和核心材质。
- 传播场景要给真实环境光,写成 studio lighting 就退回展示板了。
- 不伪造已经生成的结果。没有调用生图工具时,只声明已完成提示词。
- 避免多张图变成多个互不相关的风格案例;变化必须发生在统一规则之内。也避免反过来——每条都在重复参考图原本那个场景。