Skip to main content
Ejecuta cualquier Skill en Manus
con un clic

llm-4bit-nf4-double-quantization

Estrellas52
Forks4
Actualizado22 de abril de 2026 a las 17:42

Load large LLMs with 4-bit NF4 quantization and optional double quantization via BitsAndBytes to reduce GPU memory by 4x while preserving inference quality

Instalación

Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.

SKILL.md
readonly