Skip to main content

optimize-model-precision

Use when evaluating FP16, BF16, or supported quantization formats for a TensorRT-Model-Connect model. Establishes a model-owned correctness baseline, changes one effective build option at a time, detects ineffective precision, and retains comparable parity, memory, bundle, and performance evidence.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
NVIDIA/TensorRT-Model-Connect
آخر نشاط في المصدر
١٥ أغسطس ٢٠٢٦ في ٢٢:١٠
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٨٨
التفرعات
٣٥

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.