near-policy-distillation
Methodology for accelerating on-policy distillation via asynchronous generation and evaluation. Decouples generation from evaluation using a near-policy buffer, achieving 2-4x throughput gains without quality degradation.
Informações da origem
- Repositório
- hiyenwong/ai_collection
- Última atividade na origem
- 4 de junho de 2026 às 13:32
- Idioma detectado do SKILL.md
- inglês
- Estrelas
- 2
- Forks
- 0
Opções de instalação
Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.
Revise os arquivos de origem
Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.
Exibindo SKILL.md
- name
- near-policy-distillation
- description
- Methodology for accelerating on-policy distillation via asynchronous generation and evaluation. Decouples generation from evaluation using a near-policy buffer, achieving 2-4x throughput gains without quality degradation.
- category
- deep-learning
- tags
- ["LLM","distillation","RL","training-efficiency","async-compute"]
- trigger
- distillation, on-policy distillation, async generation, NPD, teacher-student, throughput optimization