post-training
当你要通过更新模型权重来提升 Agent 能力(Mid-training 补知识、SFT 固化格式、RL 泛化策略、蒸馏降成本)时使用;当需要判断"某个问题该靠 prompt 解决还是值得训练"时使用。核心认识:数据和环境比算法更重要;SFT 记忆、RL 泛化。不适用于 Harness/上下文层的能力提升。
来源信息
- 仓库
- GongLingRui/agent-dev-skills
- 最近来源活动
- 2026年8月27日 01:47
- 检测到的 SKILL.md 语言
- 中文
- 星标
- 1
- 分支
- 0
安装方式
默认使用会先检查来源的 Prompt;你也可以切换为直接命令,或下载本地副本。
检查来源文件
决定是否安装前,请先阅读 SKILL.md,以及 SkillsMP 当前展示的配套文件。