Skip to main content

perf-host-optimization

Profiles and optimizes TensorRT-LLM host/CPU overhead using line_profiler (with nsys support planned). Runs iterative profile-analyze-optimize-validate rounds. Use when GPU utilization is low or optimizing PyExecutor throughput.

Zur Installation springen

Quellinformationen

Repository
NVIDIA/TensorRT-LLM
Letzte Quellaktivität
20. Mai 2026 um 07:35
Erkannte Sprache von SKILL.md
Englisch
Sterne
14.502
Forks
2.700

Installationsoptionen

Standardmäßig ist der Prompt ausgewählt, der zuerst die Quelle prüft. Sie können zu einem direkten Befehl wechseln oder eine lokale Kopie herunterladen.

Quelldateien prüfen

Lesen Sie SKILL.md und alle von SkillsMP angezeigten Begleitdateien, bevor Sie sich für eine Installation entscheiden.