Skip to main content

triton-cuda-matmul

矩阵乘法算子(matmul/bmm/linear)优化策略,包括分块 Tiling、共享内存缓存、Tensor Core 利用和大矩阵处理技巧。适用于实现 GEMM、批量矩阵乘、全连接层等矩阵运算的 CUDA 内核代码生成场景

Ir para a instalação

Informações da origem

Repositório
mindspore-ai/akg
Última atividade na origem
8 de abril de 2026 às 01:35
Idioma detectado do SKILL.md
chinês
Estrelas
259
Forks
48

Opções de instalação

Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.

Revise os arquivos de origem

Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.