“Energy-Efficient NLP Through Tiny-Model Distillation, Pruning, and Quantized Inference”. Kashf Journal of Multidisciplinary Research 3, no. 05 (July 10, 2026): 1–8. Accessed September 18, 2026. https://kjmr.ac.pk/kjmr/article/view/965.