Skip to main content
Manusで任意のスキルを実行
ワンクリックで

llm-4bit-nf4-double-quantization

スター52
フォーク4
更新日2026年4月22日 17:42

Load large LLMs with 4-bit NF4 quantization and optional double quantization via BitsAndBytes to reduce GPU memory by 4x while preserving inference quality

インストール

Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。

SKILL.md
readonly