Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

flash-attention

النجوم١٣١
التفرعات٢٤
آخر تحديث٧ أبريل ٢٠٢٦ في ٠٦:٣٨

Optimize transformer attention with Flash Attention — 2-4x speedup, 10-20x memory reduction for long sequences on CUDA GPUs.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly