Skip to main content
Execute qualquer Skill no Manus
com um clique

llm-4bit-nf4-double-quantization

Estrelas52
Forks4
Atualizado22 de abril de 2026 às 17:42

Load large LLMs with 4-bit NF4 quantization and optional double quantization via BitsAndBytes to reduce GPU memory by 4x while preserving inference quality

Instalação

Instalar com Codex ou Claude Copie este prompt, cole no Codex, Claude ou outro assistente e deixe que ele revise a página da skill e instale para você.

SKILL.md
readonly