Skip to main content

multimodal-learning

Multi-modal learning, vision-language models, and cross-modal representation

Aller à l'installation

Informations de source

Dépôt
NeuralBlitz/Mito
Dernière activité de la source
22 mars 2026 à 13:29
Langue détectée de SKILL.md
anglais
Étoiles
0
Forks
0

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.

Affichage de SKILL.md

SKILL.md
Instructions source · Aperçu en lecture seule
name
multimodal-learning
description
Multi-modal learning, vision-language models, and cross-modal representation
license
MIT
compatibility
opencode
metadata
{"audience":"researchers","category":"machine-learning"}
## What I do - Build models that process multiple modalities - Work with vision-language models - Align different data types - Fuse multimodal representations ## When to use me When working on multimodal AI or vision-language systems. ## Key Concepts - Vision-language models - Cross-modal attention - Representation learning - CLIP - Image captioning - Visual question answering - Audio-visual learning
Voir sur GitHub