Skip to main content

add-inference-backend

Add a new hardware inference backend to AutoRound for deploying quantized models (e.g., CUDA/Marlin, Triton, CPU, HPU, ARK). Use when implementing QuantLinear kernels, registering backend capabilities, or enabling quantized model inference on a new hardware platform.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
intel/auto-round
آخر نشاط في المصدر
١١ مايو ٢٠٢٦ في ٠٢:٣٠
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٬٦٠٦
التفرعات
١٧٥

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.