Skip to main content

qwopus27b-rl-training

Prepare, validate, launch-plan, monitor, resume, and stop configurable Qwopus 27B reinforcement-learning workflows for GRPO or GSPO. Use when Codex needs to turn an editable Goal template and user config into a safe local or SSH RL training plan without overstating dry-run results or relabeling SFT, GRPO, GSPO, or other algorithms.

Ir para a instalação

Informações da origem

Repositório
R6410418/Jackrong-llm-finetuning-guide
Última atividade na origem
31 de maio de 2026 às 15:34
Idioma detectado do SKILL.md
inglês
Estrelas
1.652
Forks
265

Opções de instalação

Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.

Revise os arquivos de origem

Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.