Skip to main content

sparse-linear-expert-transformer

Sparsely gated tiny linear experts (sgatlin) methodology — replacing transformer feedforward layers with networks of sparsely-gated linear neurons for improved compute efficiency and interpretability. Covers isoflop comparison, linear expert removal of nonlinearity, semantic cluster interpretation, and causal factual recall. Activation: sparse linear expert, sgatlin, tiny linear expert, sparsely gated linear, linear MoE, sparse transformer FFN.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
hiyenwong/ai_collection
آخر نشاط في المصدر
٧ يوليو ٢٠٢٦ في ٠٨:٢٦
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٢
التفرعات
٠

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.