Skip to main content

optimize-llm-cost-latency

Cuts LLM token cost and tail latency via context trimming, provider prompt caching on stable prefixes, model tiering/routing, semantic answer caching, batch APIs, and streaming, proving a measured before/after on cost-per-request and p50/p95 at equal output quality.

Zur Installation springen

Quellinformationen

Repository
Sir-chawakorn/sanook-cli
Letzte Quellaktivität
15. Juni 2026 um 00:33
Erkannte Sprache von SKILL.md
Englisch
Sterne
9
Forks
3

Installationsoptionen

Standardmäßig ist der Prompt ausgewählt, der zuerst die Quelle prüft. Sie können zu einem direkten Befehl wechseln oder eine lokale Kopie herunterladen.

Quelldateien prüfen

Lesen Sie SKILL.md und alle von SkillsMP angezeigten Begleitdateien, bevor Sie sich für eine Installation entscheiden.