multimodal-ai
Patterns for building multimodal AI applications that combine text, images, audio, and video. Covers vision APIs, audio transcription, and unified pipelines. Use when "multimodal AI, vision API, image understanding, GPT-4V, Claude vision, audio transcription, Whisper, document extraction, image to text, " mentioned.
ソース情報
- リポジトリ
- omer-metin/skills-for-antigravity
- ソースの最終更新活動
- 2026年1月22日 14:14
- 検出された SKILL.md の言語
- 英語
- スター
- 128
- フォーク
- 24
インストール方法
デフォルトでは、最初にソースを確認する Prompt が選択されています。直接コマンドに切り替えるか、ローカルコピーをダウンロードすることもできます。
ソースファイルを確認
インストールを決める前に、SKILL.md と SkillsMP に表示されている付属ファイルをお読みください。