Skip to main content

triton-cuda-matmul

矩阵乘法算子(matmul/bmm/linear)优化策略,包括分块 Tiling、共享内存缓存、Tensor Core 利用和大矩阵处理技巧。适用于实现 GEMM、批量矩阵乘、全连接层等矩阵运算的 CUDA 内核代码生成场景

Zur Installation springen

Quellinformationen

Repository
mindspore-ai/akg
Letzte Quellaktivität
8. April 2026 um 01:35
Erkannte Sprache von SKILL.md
Chinesisch
Sterne
259
Forks
48

Installationsoptionen

Standardmäßig ist der Prompt ausgewählt, der zuerst die Quelle prüft. Sie können zu einem direkten Befehl wechseln oder eine lokale Kopie herunterladen.

Quelldateien prüfen

Lesen Sie SKILL.md und alle von SkillsMP angezeigten Begleitdateien, bevor Sie sich für eine Installation entscheiden.