Skip to main content

fastllm-triton-ops

Guide for adding Triton-backed CUDA operators to FastLLM. Use when modifying FastLLM CUDA op code to add, extend, debug, validate, or benchmark Triton-generated kernels through tools/fastllm_triton_server.py, src/devices/cuda/cudadevice.cpp, src/devices/cuda/fastllm-triton-cuda.cu, include/devices/cuda/fastllm-cuda.cuh, or related CMake wiring.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
ztxz16/fastllm
آخر نشاط في المصدر
٩ يونيو ٢٠٢٦ في ٠٤:٥٦
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٤٬٩٥٦
التفرعات
٤٨٦

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.