Skip to main content
Exécutez n'importe quel Skill dans Manus
en un clic

llm-4bit-nf4-double-quantization

Étoiles52
Forks4
Mis à jour22 avril 2026 à 17:42

Load large LLMs with 4-bit NF4 quantization and optional double quantization via BitsAndBytes to reduce GPU memory by 4x while preserving inference quality

Installation

Installer avec Codex ou Claude Copiez ce prompt, collez-le dans Codex, Claude ou un autre assistant, puis laissez-le vérifier la page du skill et l'installer pour vous.

SKILL.md
readonly