Srinivasaraghavan, R. (2026) “Quantization and Compression Techniques for Model Deployment: Optimizing Neural Networks for Production”, International Journal of Artificial Intelligence, Data Science, and Machine Learning, 7(3), pp. 131–139. doi:10.63282/3050-9262.IJAIDSML-V7I3P115.