Skip to main content

rhoai-distributed-inference-llmd

Use when documenting, reviewing, or rebuilding Red Hat OpenShift AI Distributed Inference with llm-d from the official deployment guide: LLMInferenceService resources, Gateway API discovery and selection, OpenShift Gateway Controller requirements, LeaderWorkerSet Operator prerequisites, Red Hat Connectivity Link and Kuadrant authentication, Authorino TLS setup, security.opendatahub.io/enable-auth, ServiceAccount JWT inference access, vLLM argument configuration for llm-d deployments, Endpoint Picker scheduler settings, ConfigMap-based scheduler references, Workload Variant Autoscaler enablement, VariantAutoscaling resources, saturation scaling ConfigMaps, mixed-workload flow control, InferenceObjective priority queuing, and llm-d observability. Do NOT use for standard single-model KServe deployment without llm-d (use rhoai-model-deployment), model-serving platform/runtime setup (use rhoai-model-serving-platform), MaaS governance over llm-d endpoints (use rhoai-maas-governance), Kueue/Ray/Training distributed

Ir a la instalación

Datos de origen

Repositorio
adnan-drina/rhoai3-coding-demo
Última actividad en el origen
6 de julio de 2026 a las 18:02
Idioma detectado de SKILL.md
inglés
Estrellas
3
Forks
2

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.