Skip to main content

cuda-cutlass-fmha-incremental-rebuild

Use when rebuilding ONNX Runtime CUDA after editing CUTLASS fused-MHA headers (onnxruntime/contrib_ops/cuda/bert/cutlass_fmha/*.h such as kernel_forward.h or fmha_launch_template.h), or when a header edit "passed" an incremental build but test behavior did not change. Explains the nvcc depfile gotcha that produces stale Memory-Efficient-Attention (MEA) kernels and binaries, and how to force a correct recompile. Also covers disk-space frugality on shared GPU dev boxes.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
microsoft/onnxruntime
آخر نشاط في المصدر
٢١ أغسطس ٢٠٢٦ في ٠١:٠٤
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٢١٬٦٨١
التفرعات
٤٬١٨٩

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.