Skip to main content

intel-neural-compressor

Intel Neural Compressor — SOTA low-bit LLM quantization (INT8/FP8/INT4/NVFP4), sparsity, pruning, and distillation for PyTorch, TensorFlow, and ONNX Runtime.

Aller à l'installation

Informations de source

Dépôt
mkurman/zorai
Dernière activité de la source
12 mai 2026 à 17:36
Langue détectée de SKILL.md
anglais
Étoiles
320
Forks
26

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.