Skip to main content

model-compress-skill

太极平台「模型压缩」子 skill —— 通过 MCP 协议对模型进行数值精度压缩(量化,如 W4A8-FP8 / W8A8-FP8 等 W{n}A{n}-{精度} 策略)。当用户提及"模型压缩 / 量化 / W4A8 / W8A8 / FP8 / GPTQ / AWQ / SmoothQuant / INT8 / INT4 / 知识蒸馏 / pruning / quantization / distillation"等关键词时,应使用本 skill。

الانتقال إلى التثبيت

معلومات المصدر

المستودع
liuhanzuo/Mixture-of-Memory
آخر نشاط في المصدر
١٧ أغسطس ٢٠٢٦ في ٠٤:٢١
لغة SKILL.md المكتشفة
الصينية
النجوم
٤
التفرعات
١

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.