“Energy-Efficient NLP Through Tiny-Model Distillation, Pruning, and Quantized Inference”. Kashf Journal of Multidisciplinary Research, vol. 3, no. 05, July 2026, pp. 1-8, https://doi.org/10.71146/kjmr965.