Skip to main content

perf-host-optimization

Profiles and optimizes TensorRT-LLM host/CPU overhead using line_profiler (with nsys support planned). Runs iterative profile-analyze-optimize-validate rounds. Use when GPU utilization is low or optimizing PyExecutor throughput.

Ir a la instalación

Datos de origen

Repositorio
NVIDIA/TensorRT-LLM
Última actividad en el origen
20 de mayo de 2026 a las 07:35
Idioma detectado de SKILL.md
inglés
Estrellas
14.502
Forks
2700

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.