Skip to main content

perf-host-optimization

Profiles and optimizes TensorRT-LLM host/CPU overhead using line_profiler (with nsys support planned). Runs iterative profile-analyze-optimize-validate rounds. Use when GPU utilization is low or optimizing PyExecutor throughput.

Ir para a instalação

Informações da origem

Repositório
NVIDIA/TensorRT-LLM
Última atividade na origem
20 de maio de 2026 às 07:35
Idioma detectado do SKILL.md
inglês
Estrelas
14.502
Forks
2.700

Opções de instalação

Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.

Revise os arquivos de origem

Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.