ワンクリックで
gemini-image-gen
使用 Gemini 生成和编辑配图。支持手绘白板风、精致矢量图风、温馨卡通信息图等六种预设模板,项目可自定义模板覆盖默认值。当用户需要为文章、文档生成插图、配图、概念图,或基于已有图片进行编辑时使用。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
使用 Gemini 生成和编辑配图。支持手绘白板风、精致矢量图风、温馨卡通信息图等六种预设模板,项目可自定义模板覆盖默认值。当用户需要为文章、文档生成插图、配图、概念图,或基于已有图片进行编辑时使用。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
Generate videos using Google Veo API (veo-3.1-fast-generate-preview). Supports three modes: (1) text-to-video — user provides a prompt, generate directly; (2) video-to-prompt — user uploads a reference video, analyze with Gemini VLM to generate structured Veo prompts, discuss and refine, then generate; (3) image-referenced generation — use a reference image to guide composition/style. Triggers when user asks to generate a video, create a video from a prompt, use Veo, analyze a video for prompt generation, or produce a short video clip. Uses Gemini API key and SOCKS5 proxy automatically.
语音口述驱动的文章创作流程。用户通过发送语音录音提供素材,AI 转录、整理、多轮迭代,最终输出结构化 Markdown 文章。支持截图标注 review(红色=删除,黄色=修改)和封面图生成。适合 OpenClaw 等对话式 Agent 使用。触发场景:用户发送语音录音要写文章、说"根据这段录音整理成文章"、"帮我把这几段语音整理一下",或发送截图要求按标注修改文章时使用。不适用于需要多 Agent 协作、素材调研、事实核查的长文创作(请用 writing-team skill)。
7 人 AI 写作团队编排。启动素材猎手、主笔、事实核查、风格审计、标题工匠协作完成长文创作。 触发场景:用户要求写自媒体长文、需要素材调研或事实核查、提到"用我的风格写"、"去 AI 味"、"多角度打磨"。 仅支持 Claude Code(依赖 Agent Teams 实验功能),不适用于 OpenClaw 等对话式 Agent。 不适用于语音录音整理(请用 voice-article skill)。
将 Markdown 文章规范化处理后发布到微信公众号草稿箱。依赖 wenyan-mcp(MCP 工具)和 gemini-image-gen skill(封面图生成)。触发场景:用户说"发布到微信"、"发到公众号"、"推送文章"、"发布这篇文章",或提供 markdown 文件要求发布到微信公众号时使用。
从抖音视频中提取文案。支持 OCR(硬字幕识别)和 ASR(语音识别)两种模式,并自动进行专业术语订正。当用户需要提取抖音视频文案、字幕、或处理抖音链接时使用。
将用户上传的图片背景去掉,输出透明背景的 PNG。适用于棋盘格/双色背景:先从边缘像素聚类得到两种背景色,再用 ImageMagick 的连通 floodfill 将背景变为透明。
| name | gemini-image-gen |
| description | 使用 Gemini 生成和编辑配图。支持手绘白板风、精致矢量图风、温馨卡通信息图等六种预设模板,项目可自定义模板覆盖默认值。当用户需要为文章、文档生成插图、配图、概念图,或基于已有图片进行编辑时使用。 |
| allowed-tools | Read, Bash, Grep, Glob, Write |
通过 Google Gemini API 生成和编辑文章配图,内置两种风格模板,项目可自定义扩展。
脚本会自动从 ~/.zshrc、~/.zshenv、~/.bashrc、~/.profile 中读取 GEMINI_API_KEY,无需手动 source。代理也会自动探测本地 SOCKS5 端口(1080/7890/7891)。
如需手动配置:
# 必须:Gemini API Key(https://aistudio.google.com/apikey)
# 通常已在 ~/.zshrc 中设置,脚本会自动读取
export GEMINI_API_KEY='your-key'
# 可选:代理配置(脚本会自动探测本地 SOCKS5 端口)
# 不需要代理时设置为 none
export GEMINI_PROXY='none'
# 可选:模型选择(默认 gemini-3-pro-image-preview)
export GEMINI_MODEL='gemini-2.5-flash-image'
读取提示词模板,优先级从高到低:
.gemini-image-templates.yaml$SKILL_DIR/templates/default.yaml# 检查项目是否有自定义模板
if [ -f ".gemini-image-templates.yaml" ]; then
echo "使用项目自定义模板"
else
echo "使用默认模板: $SKILL_DIR/templates/default.yaml"
fi
默认模板包含六种风格:
| 模板 | 名称 | 适用场景 |
|---|---|---|
template_a_handdrawn | 手绘白板风 | 概念解释、前后对比、简单流程、一句话总结 |
template_b_vector | 精致矢量图风 | 技术概念、工具介绍、系统关系、抽象概念具象化 |
template_c_4panel_comic | 四格漫画 | 起承转合故事、流程展示、幽默段子、技术拟人化 |
warm-cartoon-multicolor | 温馨卡通多彩版 | 流程说明、知识科普、产品介绍(白底+元素语义配色) |
warm-cartoon-monotone | 温馨卡通单色版 | 同上,单色调统一感(奶油底+主色调倾向) |
warm-cartoon-minimal | 温馨卡通极简版 | 同上,极简提示词让模型发挥(奶油底+超简表情) |
根据配图内容选择合适的模板。从 YAML 中取出 style 各字段,拼接为完整 prompt:
[style.base]
[style.color]
[style.typography]
[style.text_quality]
[style.composition]
[style.resolution]
Scene ([default_aspect_ratio] aspect ratio):
[用户描述的具体画面内容]
Chinese labels: [需要出现的中文文字]
prompt 组装规则:
# 生成新图片(指定输出路径)
bash $SKILL_DIR/scripts/gen-image.sh -o <output_path> "<prompt>"
# 生成新图片(不指定路径,默认保存到当前目录 ./generated-YYYYMMDD-HHMMSS.png)
bash $SKILL_DIR/scripts/gen-image.sh "<prompt>"
# 编辑已有图片
bash $SKILL_DIR/scripts/gen-image.sh -i <input_image> -o <output_path> "<prompt>"
脚本说明:
-o 输出路径,支持任意 png/jpg 路径,目录不存在会自动创建。省略时默认保存到当前工作目录-i 输入图片路径(可选),用于基于已有图片进行编辑gemini-3-pro-image-preview 模型(中文文字渲染最好)生成后必须用 Read 工具查看图片,检查:
如果中文有误,优先尝试:缩短文字(6字→2字)、换用更常见的词、调整文字位置到更空旷的区域。
为一篇文章生成多张配图时的典型流程:
# 读取文章,找出所有 [配图建议: xxx] 标记
# 为每个标记选择模板、组装 prompt、调用脚本
STYLE_A="Hand-drawn whiteboard sketch illustration style. White background. Black ink hand-drawn line art..."
TEXT_RULES="CRITICAL: All Chinese characters must be sharp, crisp..."
# 配图1:手绘风
bash $SKILL_DIR/scripts/gen-image.sh -o ./images/01-concept.png "${STYLE_A} ${TEXT_RULES} Scene (4:3 aspect ratio): ..."
# 配图2:矢量风
bash $SKILL_DIR/scripts/gen-image.sh -o ./images/02-architecture.png "${STYLE_B} ${TEXT_RULES} Scene (4:3 aspect ratio): ..."
基于已有图片进行修改,用 -i 传入原图:
# 修改配色
bash $SKILL_DIR/scripts/gen-image.sh -i ./images/01-concept.png -o ./images/01-concept-v2.png "Change the accent color from red to blue, keep everything else the same"
# 添加元素
bash $SKILL_DIR/scripts/gen-image.sh -i ./images/02-arch.png -o ./images/02-arch-v2.png "Add a database icon on the right side connected with an arrow"
# 扩展画布
bash $SKILL_DIR/scripts/gen-image.sh -i ./hero.png -o ./hero-wide.png "Extend this image to 21:9 aspect ratio, expanding the background naturally on both sides"
编辑时的 prompt 不需要重复完整的风格模板,只需描述要做的修改。模型会保持原图的风格和内容,仅应用指定的变更。
在项目根目录创建 .gemini-image-templates.yaml,格式与默认模板一致:
# .gemini-image-templates.yaml
template_a_handdrawn:
name: "我的手绘风"
style:
base: >
...自定义风格描述...
color: >
...自定义配色...
# 其他字段同默认模板结构
default_aspect_ratio: "16:9"
# 可以添加更多自定义模板
template_c_custom:
name: "品牌风格"
style:
base: >
...
User location is not supported,需走 SOCKS5| 需求 | 推荐模型 |
|---|---|
| 中文文字清晰 | gemini-3-pro-image-preview(默认) |
| 快速迭代/草稿 | gemini-2.5-flash-image |
| 复杂场景/4K | gemini-3-pro-image-preview |