用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/qq5855144/GitHubM --skill image-generation-super命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
高级图片生成与编辑,支持文生图、图生图、多图合成,异步任务轮询。需要 AI 生成图片、对图片做内容编辑或风格转换时优先使用该工具。
基于 SOC 职业分类
正在显示 SKILL.md
| name | image-generation-super |
| description | 图片生成与编辑(超级版),调用 GPT-Image-2 模型生成和编辑图片。需要 AI 画图、生成图片、编辑图片、多图融合、背景替换、风格转换、电商商品图合成、海报设计、插画创作时优先使用该工具。 |
| license | MIT |
调用 GPT-Image-2 模型进行 AI 图像生成与编辑,支持通过自然语言描述生成高质量图片,以及上传多张图片进行 AI 编辑融合。
| 属性 | 值 |
|---|---|
| Plugin ID | e480d4b6-835c-45f8-a494-d38da962b394 |
| 认证模式 | platform_managed(密钥由平台注入) |
| 密钥来源 | process.env["INTEGRATIONS_API_KEY"] |
| Auth Header | X-Gateway-Authorization: Bearer <key> |
| 支持平台 | Web、MiniProgram |
| 响应格式 | JSON,图片以 Base64 编码内嵌于 data[].b64_json |
接口列表:
| 接口 | 方法 | Endpoint | 说明 |
|---|---|---|---|
| 创建图片 | POST | http://app-bo4w33bsdqm9-api-wLNdpny6ZpVa-gateway.appmiaoda.com/v1/images/generations | 根据文本描述生成图片 |
| 编辑图片 | POST | http://app-bo4w33bsdqm9-api-baBw3XMNVmv9-gateway.appmiaoda.com/v1/images/edits | 上传 1–3 张图片进行 AI 编辑融合 |
核心能力:
prompt 描述生成全新图片,支持多种尺寸和数量配置revised_prompt,展示模型自动优化后的提示词平台差异概览:
| 平台 | Edge Function 返回 | 前端获取图片方式 |
|---|---|---|
| Web | JSON(含 Base64) | 解析 JSON,构造 data:image/png;base64,... URI 或用 Blob 渲染 |
| MiniProgram | JSON(含 Base64) | 解析 JSON,写临时文件后用 <image> 组件展示 |
详细参数说明、代码示例及两平台完整实现见:
references/image-generations-api.md — 创建图片接口references/image-edits-api.md — 编辑图片接口调用本工具前,先判断场景是否真的需要 AI 生成:
| 场景 | 推荐方案 |
|---|---|
| 根据文字描述生成全新图片 | ✅ 本工具(文生图) |
| 上传图片 + 提示词做风格转换或内容编辑 | ✅ 本工具(图生图) |
| 多张图片融合 / 背景替换 / 海报合成 | ✅ 本工具(多图编辑) |
| 图片内容审核 / 质量评分 | ❌ 改用视觉模型直接分析,无需生成 |
图生图优先原则(重要):
满足以下任一条件时,必须使用 editImage(图生图)接口,禁止使用 createImage(文生图):
用户提出的修改意见(如"换个背景"、"改成卡通风格"、"让颜色更鲜艳")均属于对已有图片的编辑,必须走图生图流程。
禁止覆盖原图: 编辑后的图片必须保存为新文件(如在原文件名后加 _v2、_edited 或序号),原始图片文件不得修改或删除。
底层模型(GPT-Image-2)对英文提示词的理解和图像质量通常优于中文,请优先将用户需求改写为英文后再提交 API。
写作原则:
"a ginger cat sitting in a sunlit garden" 好于 "可爱的猫""no background",改写 "isolated on pure white background"high quality, detailed, 8k, photorealistic文生图模板:
[Subject], [Action/Pose/State], [Scene/Environment], [Lighting], [Style], [Quality]
示例:
A golden retriever puppy, sitting and looking up curiously, in a cozy living room with warm afternoon lighting, watercolor illustration style, high quality, detailed
图生图 / 多图编辑额外建议:
"convert to anime style" 或 "oil painting style""use image 1 as background, place the product from image 2 in the center"在调用 API 之前,先将用户需求翻译/改写为英文提示词,GPT-Image-2 模型对英文输入的图像质量明显优于中文。
两个接口均为同步调用,直接返回 Base64 编码图片,不含 URL。
核心原则:Base64 数据绝不进入模型上下文。 图片 Base64 通常达 1–3 MB,折合 25 万–75 万 token。应直接调用 scripts/generate_image.py,脚本内完成请求、解码、写文件全部操作,模型只接收最终元数据。
完整生成期工作流:
--images;纯文字描述 → 不加_v2 / _edited 后缀)file 和 revised_prompt 告知用户文生图:
python3 <skill-path>/scripts/generate_image.py \
--prompt "ENGLISH_PROMPT_HERE" \
--output image.png \
--size 1024x1024
图生图 / 多图编辑:
python3 <skill-path>/scripts/generate_image.py \
--prompt "ENGLISH_PROMPT_HERE" \
--output image_v2.png \
--size 1024x1024 \
--images /path/to/img1.png [/path/to/img2.png]
脚本成功时 stdout 输出:{"file": "image.png", "revised_prompt": "...", "size": "1024x1024"}
Prompt 空间位置增强(可选):
加入空间位置词可提高构图准确性:centered、in the top-left corner、in the foreground / background、on the left side / right side、filling the entire frame。
应用内通过 Edge Function 安全调用上游 API,密钥不暴露给前端。
安全合约:
Deno.env.get("INTEGRATIONS_API_KEY") 读取密钥X-Gateway-Authorization: Bearer ${apiKey}429(配额超限)和 402(余额不足)错误体原样透传给前端Edge Function 实现:
image-generations:代理创建图片接口,处理 JSON 请求image-edits:代理编辑图片接口,处理 multipart/form-data 请求完整 Edge Function 代码和前端调用代码详见:
references/image-generations-api.md(创建图片的 Edge Function + 前端代码)references/image-edits-api.md(编辑图片的 Edge Function + 前端代码)| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 固定值:gpt-image-2 |
prompt | string | 是 | 图片生成描述词 |
size | string | 否 | 输出尺寸:1024x1024、1536x1024、1024x1536、2848x1152 |
n | integer | 否 | 生成数量,默认 1 |
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 固定值:gpt-image-2 |
prompt | string | 是 | 图片编辑描述词 |
size | string | 否 | 输出尺寸 |
n | integer | 否 | 输出数量,默认 1 |
image[0] | file | 是 | 主图片文件 |
image[1] | file | 否 | 附加图片文件 |
image[2] | file | 否 | 附加图片文件 |
| 字段路径 | 类型 | 说明 |
|---|---|---|
created | number | 创建时间戳 |
data | array | 生成结果列表 |
data[].b64_json | string | Base64 编码图片内容 |
data[].revised_prompt | string | 模型自动优化后的提示词 |
usage | object | Token 消耗统计(仅编辑接口返回) |
_v2 / _edited / 序号),原始文件不得修改或删除。process.env["INTEGRATIONS_API_KEY"] 注入;Edge Function 用 Deno.env.get("INTEGRATIONS_API_KEY"),严禁暴露到前端。image[0] 必填),需确保图片格式和大小符合上游要求。429 配额耗尽 / 402 余额不足 / 400 参数错误 / 401 认证失败。enable_billing: false),但仍需确保 API Key 有效且配额充足。