V, Damodaran; M, Balasubramanian; M G, Jibukumar; I S, Smitha. A Hybrid Vision–Language Framework For Unified Image–Video Captioning And Semantic Visual Question Answering. International Journal of Artificial Intelligence and Machine Learning, [S. l.], v. 6, n. 7s, p. 790–807, 2026. DOI: 10.51483/IJAIML.6.7s.2026.790-807. Disponível em: https://www.svedbergopen.com/index.php/ijaiml/article/view/1125. Acesso em: 13 sep. 2026.