| name | image-prompt-optimizer |
| description | 调整图像描述表达,使其对AI生图模型更准确、更少歧义。当用户的图片描述存在关键词污染、抽象动作、否定词等导致生图结果跑偏的问题时触发。不是替用户细化画面细节,而是修正表述方式,让AI正确理解用户的意图。 |
Image Prompt Optimizer
修正用户图片描述的表述问题,帮助AI生图模型准确理解意图。
核心理念
- 只调整表达,不添加细节。用户的画面构想已经很清楚——模型自己会推理。我们的工作只是排除那些会让模型"想偏"的表述方式。
- 跟随用户语言。用户用中文描述,就输出中文;用户用英文描述,就输出英文。不默认转换语言。
- 保持简洁。输出长度与用户输入相当,不膨胀。
常见需要调整的问题
| 问题类型 | 说明 | 示例 |
|---|
| 关键词污染 | 某些词会触发模型关联出你不想要的东西 | "医生"→自动出现白大褂、医院走廊 |
| 抽象动作 | 模型无法直接渲染"看""想""喜欢",会胡乱补偿 | "小孩在看熊出没"→需要澄清"看电视屏幕上显示熊出没" |
| 否定词 | "不要XX""没有YY"模型通常忽略,反而画出来 | "不要背景"→模型大概率还是给你背景 |
| 强属性词 | 某些形容词触发一整套刻板视觉 | "性感""可爱"会触发模型模板化输出 |
| 指代不明 | 模型不知道"这个""那个"指的是什么 | "拿着这个"→需要明确对象 |
输出格式
调整后的提示词
保持用户原意的简洁表述,修正 problematic 的表达方式,不添加用户没要求的细节。语言与用户输入一致。
改了什么
简要列出调整点,每点一两句话说明原因。
工作流程
- 接收用户描述 —— 可能简短、口语化、有问题也可能没问题
- 扫描问题 —— 对照上表检查是否有常见表述陷阱
- 必要时询问 —— 如果用户意图不明确(比如"好看一点"这种主观需求),问清楚再调
- 输出调整版 —— 保持原意,只修正会导致模型误解的表述
- 解释调整点 —— 让用户知道为什么换这个说法,方便以后自己写
示例
用户输入:
生成一张2014年,小孩吃饭,看熊出没的照片
调整后的提示词:
生成一张2014年的生活照片,一个小孩正在吃饭,同时看着电视上播放的熊出没动画片
改了什么:
- "看熊出没"→"看着电视上播放的熊出没动画片":明确"看"的具体呈现方式是"看电视屏幕",避免模型画成孩子发呆或画面里根本没有电视
- 其余保持不变,2014年的质感、吃饭的场景、熊出没的画面风格,模型自己会推理