用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/XSpoonAi/spoon-awesome-skill --skill gemini-vision命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
Context-aware caption translation skill for SRT/VTT/ASS with bilingual output and optional Gemini CLI fallback.
CRITICAL: Skill composition engine for automatic workflow generation from skill metadata. Triggers: compose skills, orchestrate, workflow, combine skills, skill pipeline, multi-skill, 技能组合, 工作流编排, 技能发现, 自动编排, skill discovery, semantic matching, StateGraph generation
Intelligent content optimization framework for preparing data and content for AI/ML training pipelines with quality analysis, dataset optimization, and hyperparameter suggestions.
基于 SOC 职业分类
正在显示 SKILL.md
| name | gemini-vision |
| description | Analyze images using Google Gemini 2.0 Flash with proxy support, retry logic, and mock mode. |
| version | 1.0.0 |
| author | Moxan <namemoxan@gmail.com> |
| tags | ["ai","vision","gemini","image-analysis"] |
A robust SpoonOS skill for analyzing images using Google's Gemini 2.0 Flash model. It is designed for production environments with built-in support for HTTP proxies, automatic retries for rate limits, and a mock mode for testing without API costs.
from spoon.skills.gemini_vision import vision_analyze
# Analyze an image
with open("image.jpg", "rb") as f:
image_bytes = f.read()
result = await vision_analyze(
image=image_bytes,
prompt="Describe this image"
)
print(result)
| Script | Purpose |
|---|---|
| main.py | Main implementation of the vision analysis logic |
| Variable | Required | Description |
|---|---|---|
GEMINI_API_KEY | Yes | Your Google Gemini API key |
HTTPS_PROXY | No | Proxy URL (e.g., http://127.0.0.1:7890) |
MOCK_VISION | No | Set to true to enable mock mode |
GEMINI_MODEL | No | Model name (default: gemini-2.5-flash) |
MOCK_VISION=true during development to save API quota.HTTPS_PROXY is set.