Srinivasaraghavan, R. (2026). Quantization and Compression Techniques for Model Deployment: Optimizing Neural Networks for Production. International Journal of Artificial Intelligence, Data Science, and Machine Learning, 7(3), 131-139. https://doi.org/10.63282/3050-9262.IJAIDSML-V7I3P115