Skip to main content

airllm

Inferencia de LLMs de 70B-405B en GPU de 4GB — layer-wise sharding, lazy loading, prefetching, sin cuantización

الانتقال إلى التثبيت

معلومات المصدر

المستودع
Ntizar/koldo
آخر نشاط في المصدر
١١ يونيو ٢٠٢٦ في ٠٦:٢٨
لغة SKILL.md المكتشفة
الإسبانية
النجوم
٠
التفرعات
٠

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.