[1]
R. Srinivasaraghavan, “Quantization and Compression Techniques for Model Deployment: Optimizing Neural Networks for Production”, IJAIDSML, vol. 7, no. 3, pp. 131–139, Sep. 2026, doi: 10.63282/3050-9262.IJAIDSML-V7I3P115.