Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
직접 명령은 검토 Prompt를 거치지 않습니다. 실행하기 전에 소스를 확인하세요.
npx skills add https://github.com/HorizonRobotics/OE-Skills --skill lightcompress-batch-quantize명령은 한 줄로 유지됩니다. 복사하기 전에 가로로 스크롤해 전체 내용을 확인하세요.
로컬 사본을 원하시나요? SkillsMP에서 현재 제공할 수 있는 파일을 다운로드하세요.
SKILL.md 표시 중
SOC 직업 분류 기준
| name | lightcompress-batch-quantize |
| version | 2.0.3 |
| description | 批量执行 LightCompress 量化实验并生成对比表。 |
批量执行 = 循环调用 lightcompress-quant-explore skill。本 skill 只负责编排,不重复实现单实验逻辑。
将用户输入展开为实验的笛卡尔积:models x methods x configs。
示例输入:
对 Qwen3-0.6B、Qwen2.5-7B 跑 RTN W8A8 和 GPTQ W4A8 量化
展开为 4 个实验:
调用 quant-accuracy-cache skill 查询每个实验是否已有结果。
匹配规则:model.name + quant.method + quant.w_bit + quant.a_bit。
对待执行列表中的每个实验:
lightcompress-quant-explore skill 启动实验
nvidia-smi 确认显存占用上升)自动回答子 skill 的交互问题:
| 子 skill 问题 | 预设答案 |
|---|---|
| 开始实验 / 取消 | 开始实验 |
| 保存到缓存 / 跳过 | 保存到缓存 |
| 缓存冲突处理 | 保留两者 |
所有实验完成后,汇总为对比表:
| 模型 | 方法 | 配置 | Pretrain PPL | Fake Quant PPL | PPL 变化 | 来源 |
|------|------|------|--------------|----------------|----------|------|
| Qwen3-0.6B | RTN | W8A8 | 21.30 | 22.15 | +0.85 | 实验 |
| Qwen2.5-7B | GPTQ | W4A8 | 7.00 | 7.45 | +0.45 | 缓存 |
调用 quant-accuracy-cache 保存新产生的实验结果。
| Skill | 关系 | 说明 |
|---|---|---|
lightcompress-quant-explore | 依赖 | 单实验执行引擎,负责 GPU 选择、配置生成、实验运行 |
quant-accuracy-cache | 协作 | 实验前查询缓存跳过重复,实验后保存结果 |