V, D. (2026) “A Hybrid Vision–Language Framework For Unified Image–Video Captioning And Semantic Visual Question Answering”, International Journal of Artificial Intelligence and Machine Learning, 6(7s), pp. 790–807. doi: 10.51483/IJAIML.6.7s.2026.790-807.