Skip to main content

add-inference-backend

Add a new hardware inference backend to AutoRound for deploying quantized models (e.g., CUDA/Marlin, Triton, CPU, HPU, ARK). Use when implementing QuantLinear kernels, registering backend capabilities, or enabling quantized model inference on a new hardware platform.

Aller à l'installation

Informations de source

Dépôt
intel/auto-round
Dernière activité de la source
11 mai 2026 à 02:30
Langue détectée de SKILL.md
anglais
Étoiles
1 606
Forks
175

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.