Skip to main content
mzqef
Profil créateur GitHub

mzqef

Vue par dépôt de 10 skills collectés dans 2 dépôts GitHub.

skills collectés
10
dépôts
2
mis à jour
16 mai 2026
explorateur de dépôts

Dépôts et skills représentatifs

training-campaign
Scientifiques des données

Execute and monitor long-running RL training campaigns. Progress tracking, checkpoint management, experiment logging, and resume capabilities.

12 févr. 2026
training-pipeline
Scientifiques des données

Index skill for VBot quadruped RL training. Routes to specialized skills for curriculum learning, hyperparameter optimization, reward/penalty engineering, and campaign management.

12 févr. 2026
curriculum-learning
Scientifiques des données

Multi-stage curriculum training for VBot quadruped navigation. Stage progression with warm-starts and promotion criteria.

11 févr. 2026
hyperparameter-optimization
Scientifiques des données

Unified PPO hyperparameter and reward/penalty weight search for VBot navigation. Grid, random, and Bayesian optimization across learning rate, network architecture, training dynamics, and reward scales.

11 févr. 2026
mjcf-xml-reasoning
Ingénieurs, autres

Master understanding and reasoning about MuJoCo MJCF XML model files. Enables accurate interpretation of robot/scene definitions, kinematic trees, physics configurations, and simulation parameters.

11 févr. 2026
quadruped-competition-tutor
Scientifiques des données

Comprehensive tutoring for the MotrixArena S1 quadruped robot navigation competition. Covers VBot robot design, reinforcement learning strategies, reward function engineering, terrain traversal techniques, and scoring optimization to achieve top rankings.

11 févr. 2026
reward-penalty-engineering
Ingénieurs électroniques (sauf informatique)

Methodology for exploring, testing, and archiving reward/penalty functions for VBot quadruped navigation. A process-oriented guide for systematic reward discovery.

11 févr. 2026
subagent-copilot-cli
Développeurs de logiciels

Delegate analysis tasks to GitHub Copilot CLI as a parallel subagent for MotrixLab RL project. Handles automated policy playback frame capture, VLM-based visual behavior analysis, screenshot analysis, image file inspection, simulation frame interpretation,…

11 févr. 2026
2 dépôts affichés sur 2
Tous les dépôts sont affichés