ワンクリックで
image-gen
图片生成与编辑的首选方案。当需要生成图片、编辑已有图片、或批量生成并审批时触发。触发词:"画一张""生成图片""image generation""edit this image""生成一批图让我 review""图片 gallery"。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
图片生成与编辑的首选方案。当需要生成图片、编辑已有图片、或批量生成并审批时触发。触发词:"画一张""生成图片""image generation""edit this image""生成一批图让我 review""图片 gallery"。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
Claude Code 专用:将 arXiv/DOI/PDF 学术论文整理为论文翻译飞书文档,正文以原文逐段中文翻译为主体。
单文件 HTML 幻灯片(Han Xiao 式固定舞台 deck)的制作方案。当需要做网页版 slides、HTML 幻灯片、会议演讲 deck、或希望用浏览器直接放映且导出 PDF 的演示文稿时使用。触发词:"HTML slides""网页幻灯片""单文件 deck""hanxiao 风格 slides""做个网页版演讲稿"。
Codex 专用:将 arXiv/DOI/PDF 学术论文整理为论文翻译飞书文档,正文以原文逐段中文翻译为主体。
飞书/Lark 全功能操作方案。当需要发消息、管理日程/会议室、操作云文档/多维表格/电子表格/知识库、处理任务/邮件/OKR/考勤/审批,或进行视频会议时使用。
将学术论文、论文 PDF、arXiv/DOI、或 lark-paper-reader-codex 生成的飞书论文读书文档整理成一份有用的飞书 Slides/PPT。用于把一篇或几篇论文变成可讲述、可复习、可分享的演示文稿,重点是提炼主线、选择论文原图、讲清方法、实验结果、insight 和局限;触发语境包括:把论文做成 PPT、做一份 paper slides、把这些 reader 文档整理成演示文稿、做文献汇报 slides、把同主题论文用 PPT 呈现。
统一处理所有 skills 操作的总控 skill,包括搜索、导入、创建、重构、编辑、优化、上游跟踪、分发、归档与发布。当涉及到 SKILL 的编辑修改新建时,请用 skill-manager 来管理!
| name | image-gen |
| description | 图片生成与编辑的首选方案。当需要生成图片、编辑已有图片、或批量生成并审批时触发。触发词:"画一张""生成图片""image generation""edit this image""生成一批图让我 review""图片 gallery"。 |
通用图片生成/编辑工具,支持多模型,通过本地代理服务统一调用。
本 skill 不含领域特化逻辑。 学术论文配图、演示文稿配图等专用 skill 可调用本 skill 作为底层引擎。
| 模型 | 调用方式 | 分辨率控制 | 特点 |
|---|---|---|---|
gemini-3.1-flash-image-preview | /v1/chat/completions | 自动(~1K) | 速度快,默认模型 |
gpt-image-2 | /v1/images/generations | ✅ 1K/2K | 质量高,支持精确尺寸 |
grok-4.2-image | /v1/chat/completions | 固定 ~2K | 返回远程 URL,自动下载 |
脚本路径:<skill-dir>/scripts/generate_image.py(相对于本 SKILL.md 目录)。
生成新图片:
uv run <skill-dir>/scripts/generate_image.py \
--prompt "your image description" \
--filename "output-name.png" \
[--session NAME] [--output-dir DIR] \
[--resolution 1K|2K|4K] \
[--model gemini-3.1-flash-image-preview|gpt-image-2|grok-4.2-image] \
[--no-gallery]
编辑已有图片:
uv run <skill-dir>/scripts/generate_image.py \
--prompt "editing instructions" \
--filename "output-name.png" \
--input-image "path/to/input.png" \
[--session NAME] [--resolution 1K|2K]
仅重建 Gallery HTML(不生成图片):
uv run <skill-dir>/scripts/generate_image.py --session NAME
# 或指定自定义目录
# uv run <skill-dir>/scripts/generate_image.py --output-dir ~/my-gallery
重要: 始终在用户的工作目录运行。
| 情况 | 图片位置 | Gallery 位置 |
|---|---|---|
| 什么都不指定 | ~/.local/share/image-gen/apple.png | ~/.local/share/image-gen/gallery.html |
--session NAME | ~/.local/share/image-gen/NAME/apple.png | ~/.local/share/image-gen/NAME/gallery.html |
--output-dir DIR | DIR/apple.png | DIR/gallery.html |
--filename figures/foo.png(含路径分隔符) | <CWD>/figures/foo.png(直接写入项目) | 不受影响,仍在 output-dir |
--no-gallery | 同上 | 不创建 |
设计原则:草稿 / 候选图和 gallery 默认不写入工作目录,避免污染项目。确认的终稿手动复制到项目(如
figures/)。
gemini 和 grok 的分辨率由代理服务端决定,无法通过参数精确控制;
--resolution仅作为提示传入 prompt。
默认每次生成后自动建立/更新 Gallery,位于 output-dir 中,不污染工作目录。
--session NAME 常用来隔离不同任务的 gallery:
# 每次生成都属于同一个居名 session
uv run .../generate_image.py --prompt "..." --filename "a.png" --model gemini-3.1-flash-image-preview --session my-project
uv run .../generate_image.py --prompt "..." --filename "b.png" --model gpt-image-2 --resolution 2K --session my-project
uv run .../generate_image.py --prompt "..." --filename "c.png" --model grok-4.2-image --session my-project
# Gallery 位于:~/.local/share/image-gen/my-project/gallery.html
open ~/.local/share/image-gen/my-project/gallery.html
如需在项目内用 figures/method.png 这种路径,图片会直接写入项目,而 gallery 仍在 session 目录:
uv run .../generate_image.py \
--prompt "..." \
--filename "figures/method.png" \
--session my-paper
# 图片 → <CWD>/figures/method.png
# gallery → ~/.local/share/image-gen/my-paper/gallery.html
Gallery HTML 功能:
localStorage,刷新后保留).meta.json 存储元数据代理服务已硬编码在脚本中,无需任何环境变量或配置文件:
http://localhost:8090模板:
"Create: <subject>. Style: <style>. Background: <bg>. Color palette: <palette>.""Change ONLY: <single change>. Keep identical: composition, lighting, colors, style."格式:yyyy-mm-dd-hh-mm-ss-descriptive-name.png
生成后可调用 pi-subagent 的 figure-qa agent 做视觉质量检查(参数 Scene: general)。若返回 ❌ REGENERATE,根据建议构造修复 prompt 用 --input-image 重新生成。
command -v uv # 必须存在
curl -s http://localhost:8090/v1/models -H "Authorization: Bearer <key>" | grep gpt-image-2