Harsha Sai Potluri. “NEXT-GPT: Any-to-Any Multimodal LLM for Unified Text, Image, Audio, and Video Understanding”. Acta Scientiae 27, no. 2 (April 10, 2026): 1–12. Accessed September 20, 2026. https://www.periodicos.ulbra.org/index.php/acta/article/view/685.