Skip to main content

triton-cuda-matmul

矩阵乘法算子(matmul/bmm/linear)优化策略,包括分块 Tiling、共享内存缓存、Tensor Core 利用和大矩阵处理技巧。适用于实现 GEMM、批量矩阵乘、全连接层等矩阵运算的 CUDA 内核代码生成场景

الانتقال إلى التثبيت

معلومات المصدر

المستودع
mindspore-ai/akg
آخر نشاط في المصدر
٨ أبريل ٢٠٢٦ في ٠١:٣٥
لغة SKILL.md المكتشفة
الصينية
النجوم
٢٥٩
التفرعات
٤٨

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.