near-policy-distillation
Methodology for accelerating on-policy distillation via asynchronous generation and evaluation. Decouples generation from evaluation using a near-policy buffer, achieving 2-4x throughput gains without quality degradation.
Datos de origen
- Repositorio
- hiyenwong/ai_collection
- Última actividad en el origen
- 4 de junio de 2026 a las 13:32
- Idioma detectado de SKILL.md
- inglés
- Estrellas
- 2
- Forks
- 0
Opciones de instalación
De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.
Revisa los archivos de origen
Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.
Mostrando SKILL.md
- name
- near-policy-distillation
- description
- Methodology for accelerating on-policy distillation via asynchronous generation and evaluation. Decouples generation from evaluation using a near-policy buffer, achieving 2-4x throughput gains without quality degradation.
- category
- deep-learning
- tags
- ["LLM","distillation","RL","training-efficiency","async-compute"]
- trigger
- distillation, on-policy distillation, async generation, NPD, teacher-student, throughput optimization