con un clic
model-quantization
""Quantize and optimize ML models for edge deployment across all four tiers. Use when: converting models to LiteRT, ONNX export, INT8/FP16 quantization, GGUF conversion, MLX format, BitNet 1-bit quantization, model size reduction, inference optimization, Adreno GPU delegate, NNAPI configuration, profiling model performance on target hardware.""
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.