Skip to main content

model-compress-skill

太极平台「模型压缩」子 skill —— 通过 MCP 协议对模型进行数值精度压缩(量化,如 W4A8-FP8 / W8A8-FP8 等 W{n}A{n}-{精度} 策略)。当用户提及"模型压缩 / 量化 / W4A8 / W8A8 / FP8 / GPTQ / AWQ / SmoothQuant / INT8 / INT4 / 知识蒸馏 / pruning / quantization / distillation"等关键词时,应使用本 skill。

跳到安装

来源信息

仓库
liuhanzuo/Mixture-of-Memory
最近来源活动
2026年8月17日 04:21
检测到的 SKILL.md 语言
中文
星标
4
分支
1

安装方式

默认使用会先检查来源的 Prompt;你也可以切换为直接命令,或下载本地副本。

检查来源文件

决定是否安装前,请先阅读 SKILL.md,以及 SkillsMP 当前展示的配套文件。