1.
A Survey on Hybrid Caching Techniques to Reduce Latency in Large Language Model Systems. IJLTEMAS [Internet]. 2026 May 26 [cited 2026 Aug. 7];15(5):357-65. Available from: https://www.ijltemas.in/submission/online/article/view/4714