Skip to main content

qad

Run explicitly requested ModelOpt Quantization-Aware Distillation (QAD) on Slurm through Megatron Bridge to recover a measured BF16-to-PTQ accuracy gap. Use only when the user explicitly asks for QAD, including its topology, data preparation, Slurm launch, resume, checkpoint export, or recovery decisions.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
NVIDIA/Model-Optimizer
آخر نشاط في المصدر
١٢ أغسطس ٢٠٢٦ في ١٦:٣٣
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٣٬٦٠٤
التفرعات
٥٦٧

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.