Skip to main content

multi-modal-multi-environment-machine-teaching-robust-reward

Hierarchical machine teaching algorithm for robust reward learning across multiple MDPs. Demonstrates comparisons impose stronger constraints than demonstrations in unlimited-data regime. Greedily selects informative environments then queries low-cost feedback. Activation: machine teaching, reward learning, inverse reinforcement learning, multi-environment, robust reward, feedback modalities.

Ir a la instalación

Datos de origen

Repositorio
hiyenwong/ai_collection
Última actividad en el origen
12 de julio de 2026 a las 14:22
Idioma detectado de SKILL.md
inglés
Estrellas
2
Forks
0

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.