1.
Harsha Sai Potluri. NEXT-GPT: Any-to-Any Multimodal LLM for Unified Text, Image, Audio, and Video Understanding. AS [Internet]. 2026 Apr. 10 [cited 2026 Sep. 20];27(2):1-12. Available from: https://www.periodicos.ulbra.org/index.php/acta/article/view/685