Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

optimize-llm-cost-latency

النجوم٨
التفرعات٣
آخر تحديث١٥ يونيو ٢٠٢٦ في ٠٠:٣٣

Cuts LLM token cost and tail latency via context trimming, provider prompt caching on stable prefixes, model tiering/routing, semantic answer caching, batch APIs, and streaming, proving a measured before/after on cost-per-request and p50/p95 at equal output quality.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly