Skip to main content

posttrain-practice

当你要把生产问题案例转化为后训练数据、识别后训练中的常见陷阱(过拟合/奖励黑客/数值失配/成本低估)时使用;当需要"从问题案例到参数更新"的完整链路(失败归因→轨迹前缀回归→DPO/SFT→双集验证)时使用。不适用于训练阶段选择(见 posttrain-stage)或奖励设计(见 posttrain-reward)。

跳到安装

来源信息

仓库
GongLingRui/agent-dev-skills
最近来源活动
2026年8月27日 01:47
检测到的 SKILL.md 语言
中文
星标
1
分支
0

安装方式

默认使用会先检查来源的 Prompt;你也可以切换为直接命令,或下载本地副本。

检查来源文件

决定是否安装前,请先阅读 SKILL.md,以及 SkillsMP 当前展示的配套文件。