Skip to main content

multimodal-ai

Patterns for building multimodal AI applications that combine text, images, audio, and video. Covers vision APIs, audio transcription, and unified pipelines. Use when "multimodal AI, vision API, image understanding, GPT-4V, Claude vision, audio transcription, Whisper, document extraction, image to text, " mentioned.

Ir para a instalação

Informações da origem

Repositório
omer-metin/skills-for-antigravity
Última atividade na origem
22 de janeiro de 2026 às 14:14
Idioma detectado do SKILL.md
inglês
Estrelas
128
Forks
24

Opções de instalação

Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.

Revise os arquivos de origem

Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.