ワンクリックで
whisper-transcribe
Audio-Dateien transkribieren (OGG, WAV, MP3, FLAC) — Speech-to-Text mit whisper.cpp lokal.
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
Audio-Dateien transkribieren (OGG, WAV, MP3, FLAC) — Speech-to-Text mit whisper.cpp lokal.
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
macOS PIM-Integration — Mail, Kalender, Kontakte verwalten via osascript (Apple Mail, Calendar.app, Contacts.app).
Outlook-Integration — Emails lesen/senden, Kalender, Kontakte verwalten via PowerShell (Windows) oder osascript (Mac).
macOS PIM integration — manage mail, calendar, and contacts via osascript (Apple Mail, Calendar.app, Contacts.app).
Outlook integration — read/send emails, manage calendar and contacts via PowerShell (Windows) or osascript (Mac).
Transcribe audio files (OGG, WAV, MP3, FLAC) — local speech-to-text with whisper.cpp.
Wissen in persistenten Speicher schreiben — neue Erkenntnisse, Entscheidungen oder Fakten festhalten.
| name | whisper-transcribe |
| description | Audio-Dateien transkribieren (OGG, WAV, MP3, FLAC) — Speech-to-Text mit whisper.cpp lokal. |
| user-invocable | true |
Transkribiere Audio-Dateien mit whisper.cpp (lokal, kein API-Call noetig).
tools/whisper/Release/whisper-cli (macOS/Linux) oder whisper-cli.exe (Windows)tools/whisper/models/ggml-base.bin (148MB, base)brew install ffmpeg (macOS) oder winget install Gyan.FFmpeg (Windows)Alle Pfade relativ zum Workspace-Root.
# Deutsch (Default)
bash .claude/skills/whisper-transcribe/scripts/transcribe.sh tmp/media/voice.ogg
# Englisch
bash .claude/skills/whisper-transcribe/scripts/transcribe.sh tmp/media/voice.ogg en
# Beliebige Sprache
bash .claude/skills/whisper-transcribe/scripts/transcribe.sh <audio-datei> <sprache>
Das Script macht automatisch:
# Basis-Transkription (Deutsch)
tools/whisper/Release/whisper-cli \
-m tools/whisper/models/ggml-base.bin \
-l de \
-f <audio-datei>
# Mit Textausgabe in Datei
tools/whisper/Release/whisper-cli \
-m tools/whisper/models/ggml-base.bin \
-l de -otxt \
-f <audio-datei>
| Option | Beschreibung |
|---|---|
-l LANG | Sprache (de, en, fr, ...) — Default: auto |
-t N | Threads (Default: 4) |
-otxt | Ausgabe als .txt Datei |
-ovtt | Ausgabe als .vtt (Untertitel) |
--translate | Uebersetze nach Englisch |
--no-timestamps | Keine Zeitstempel ausgeben |
| Modell | Groesse | Qualitaet | Datei |
|---|---|---|---|
| base | 148MB | gut fuer kurze Audio | ggml-base.bin |
| small | 466MB | besser fuer laengere Audio | ggml-small.bin |
| medium | 1.5GB | beste Qualitaet | ggml-medium.bin |
Groesseres Modell runterladen:
curl -sL -o tools/whisper/models/ggml-small.bin \
"https://huggingface.co/ggerganov/whisper.cpp/resolve/main/ggml-small.bin"
Falls das Script nicht geht, Schritte einzeln:
tmp/media/ffmpeg -i tmp/media/<datei>.ogg -ar 16000 -ac 1 tmp/media/<datei>.wav
tools/whisper/Release/whisper-cli \
-m tools/whisper/models/ggml-base.bin \
-l de --no-timestamps \
-f tmp/media/<datei>.wav
-ar 16000 -ac 1)