Skip to main content

multimodal-learning

Multi-modal learning, vision-language models, and cross-modal representation

Ir a la instalación

Datos de origen

Repositorio
NeuralBlitz/Mito
Última actividad en el origen
22 de marzo de 2026 a las 13:29
Idioma detectado de SKILL.md
inglés
Estrellas
0
Forks
0

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.

Mostrando SKILL.md

SKILL.md
Instrucciones de origen · Vista previa de solo lectura
name
multimodal-learning
description
Multi-modal learning, vision-language models, and cross-modal representation
license
MIT
compatibility
opencode
metadata
{"audience":"researchers","category":"machine-learning"}
## What I do - Build models that process multiple modalities - Work with vision-language models - Align different data types - Fuse multimodal representations ## When to use me When working on multimodal AI or vision-language systems. ## Key Concepts - Vision-language models - Cross-modal attention - Representation learning - CLIP - Image captioning - Visual question answering - Audio-visual learning
Ver en GitHub