intel-neural-compressor
Intel Neural Compressor — SOTA low-bit LLM quantization (INT8/FP8/INT4/NVFP4), sparsity, pruning, and distillation for PyTorch, TensorFlow, and ONNX Runtime.
Informações da origem
- Repositório
- mkurman/zorai
- Última atividade na origem
- 12 de maio de 2026 às 17:36
- Idioma detectado do SKILL.md
- inglês
- Estrelas
- 320
- Forks
- 26
Opções de instalação
Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.
Revise os arquivos de origem
Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.