Skip to main content
Execute qualquer Skill no Manus
com um clique

ai-llm-inference

Estrelas67
Forks15
Atualizado12 de março de 2026 às 17:35

LLM inference patterns — latency budgeting, caching, batching, quantization, and parallelism. Use when optimizing serving cost or tail latency.

Instalação

Instalar com Codex ou Claude Copie este prompt, cole no Codex, Claude ou outro assistente e deixe que ele revise a página da skill e instale para você.

Explorador de arquivos
30 arquivos
SKILL.md
readonly