用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/majiayu000/claude-skill-registry --skill gemini-caption-transcribe命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
LLM token logprobs and calibration. Per-decision confidence, ECE, Brier, reliability diagrams, low-confidence triage.
Analyze LLM token logprobs and calibration. Use for per-decision confidence, ECE, Brier scores, reliability diagrams, and low-confidence triage.
回顾最近 N 天的 Claude Code 使用记录——扫描原始会话数据,按主题分组汇总"我都做了什么",并从个人操作系统视角输出模式、风险与增删建议。当用户说 /recap、"看看我这几天做了什么"、"回顾一下我最近的会话"、"这两天我用 claude 干了啥"、"活动回顾" 时使用。
基于 SOC 职业分类
正在显示 SKILL.md
| name | gemini-caption-transcribe |
| description | Transcribe audio/video using Gemini 2.5/3 Pro API with structured output |
Use this skill to transcribe audio or video files using Google's Gemini API.
# Using uv (recommended)
uv pip install gemini-caption-skills
# Or using pip
pip install gemini-caption-skills
Option 1: Save to config (recommended)
from gemini_caption import set_api_key
set_api_key("your-api-key-here")
Config location: ~/.config/gemini-caption/config.json
Option 2: Environment variable
export GEMINI_API_KEY="your-api-key-here"
Option 3: Project .env file
# In your project root, create .env
GEMINI_API_KEY=your-api-key-here
from gemini_caption import get_api_key
print(get_api_key()) # Should print your key
import asyncio
from gemini_caption import GeminiTranscriber
transcriber = GeminiTranscriber(verbose=True)
transcript = asyncio.run(transcriber.transcribe_url("https://www.youtube.com/watch?v=VIDEO_ID"))
print(transcript)
import asyncio
from gemini_caption import GeminiTranscriber
transcriber = GeminiTranscriber(verbose=True)
transcript = asyncio.run(transcriber.transcribe_file("/path/to/audio.mp3"))
transcriber.write(transcript, "output.md")
from gemini_caption import GeminiTranscriber
transcriber = GeminiTranscriber()
transcript = transcriber.transcribe_sync("/path/to/video.mp4")
The transcriber produces markdown output with:
## [HH:MM:SS] Title headers**Speaker Name:** format[HH:MM:SS][Music] [00:00:08]from gemini_caption.transcription import TranscriptionConfig, GeminiTranscriber
config = TranscriptionConfig(
model_name="gemini-2.5-pro-preview-05-06", # or "gemini-3.0-pro"
language="zh", # Optional: force specific language
verbose=True,
use_thinking=True, # Enable Gemini thinking mode
)
transcriber = GeminiTranscriber(config=config)
The system prompt is loaded from src/gemini_caption/prompts/transcription_gem.txt.
You can modify this file to customize transcription behavior.