Skip to main content

intel-neural-compressor

Intel Neural Compressor — SOTA low-bit LLM quantization (INT8/FP8/INT4/NVFP4), sparsity, pruning, and distillation for PyTorch, TensorFlow, and ONNX Runtime.

Ir para a instalação

Informações da origem

Repositório
mkurman/zorai
Última atividade na origem
12 de maio de 2026 às 17:36
Idioma detectado do SKILL.md
inglês
Estrelas
320
Forks
26

Opções de instalação

Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.

Revise os arquivos de origem

Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.