A toolkit to optimize ML models for deployment for Keras and TensorFlow, including quantization and pruning.
machine-learning sparsity compression deep-learning tensorflow optimization keras ml pruning quantization model-compression quantized-training quantized-neural-networks quantized-networks
-
Updated
Sep 15, 2026 - Python