posttrain-practice
当你要把生产问题案例转化为后训练数据、识别后训练中的常见陷阱(过拟合/奖励黑客/数值失配/成本低估)时使用;当需要"从问题案例到参数更新"的完整链路(失败归因→轨迹前缀回归→DPO/SFT→双集验证)时使用。不适用于训练阶段选择(见 posttrain-stage)或奖励设计(见 posttrain-reward)。
ソース情報
- リポジトリ
- GongLingRui/agent-dev-skills
- ソースの最終更新活動
- 2026年8月27日 01:47
- 検出された SKILL.md の言語
- 中国語
- スター
- 1
- フォーク
- 0
インストール方法
デフォルトでは、最初にソースを確認する Prompt が選択されています。直接コマンドに切り替えるか、ローカルコピーをダウンロードすることもできます。
ソースファイルを確認
インストールを決める前に、SKILL.md と SkillsMP に表示されている付属ファイルをお読みください。