Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

llm-4bit-nf4-double-quantization

النجوم٥٢
التفرعات٤
آخر تحديث٢٢ أبريل ٢٠٢٦ في ١٧:٤٢

Load large LLMs with 4-bit NF4 quantization and optional double quantization via BitsAndBytes to reduce GPU memory by 4x while preserving inference quality

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly