Return to Article Details Quantization and Compression Techniques for Model Deployment: Optimizing Neural Networks for Production Download Download PDF