#001inference-god-mode1 skills00atualizado 2 de out. de 2026100% do criadorskillocupaçãodescriçãoatualizadoinference-optimizersem classificaçãoPlan, deploy, benchmark, and tune self-hosted open-weight LLM inference on one machine or Kubernetes GPU clusters, including quantization, full-context capacity, OpenAI or Anthropic APIs, cache-aware routing, and prefill/decode disaggregation.2 de out. de 2026Mostrando 1 de 1 skills coletadas.Carregar mais 0 skillsCarregando skills...