Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

ai-llm-inference

النجوم٦٧
التفرعات١٥
آخر تحديث١٢ مارس ٢٠٢٦ في ١٧:٣٥

LLM inference patterns — latency budgeting, caching, batching, quantization, and parallelism. Use when optimizing serving cost or tail latency.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

مستكشف الملفات
30 ملفات
SKILL.md
readonly