Skip to main content

multimodal-learning

Multi-modal learning, vision-language models, and cross-modal representation

Quellinformationen

Repository
NeuralBlitz/Mito
Letzte Quellaktivität
22. März 2026 um 13:29
Erkannte Sprache von SKILL.md
Englisch
Sterne
0
Forks
0

Installationsoptionen

Standardmäßig ist der Prompt ausgewählt, der zuerst die Quelle prüft. Sie können zu einem direkten Befehl wechseln oder eine lokale Kopie herunterladen.

Quelldateien prüfen

Lesen Sie SKILL.md und alle von SkillsMP angezeigten Begleitdateien, bevor Sie sich für eine Installation entscheiden.

SKILL.md wird angezeigt

SKILL.md
Quellanweisungen · Schreibgeschützte Vorschau
name
multimodal-learning
description
Multi-modal learning, vision-language models, and cross-modal representation
license
MIT
compatibility
opencode
metadata
{"audience":"researchers","category":"machine-learning"}
## What I do - Build models that process multiple modalities - Work with vision-language models - Align different data types - Fuse multimodal representations ## When to use me When working on multimodal AI or vision-language systems. ## Key Concepts - Vision-language models - Cross-modal attention - Representation learning - CLIP - Image captioning - Visual question answering - Audio-visual learning
Auf GitHub ansehen