intel-neural-compressor
Intel Neural Compressor — SOTA low-bit LLM quantization (INT8/FP8/INT4/NVFP4), sparsity, pruning, and distillation for PyTorch, TensorFlow, and ONNX Runtime.
Informations de source
- Dépôt
- mkurman/zorai
- Dernière activité de la source
- 12 mai 2026 à 17:36
- Langue détectée de SKILL.md
- anglais
- Étoiles
- 320
- Forks
- 26
Options d'installation
Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.
Vérifiez les fichiers source
Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.