B. Ankayarkanni, D. Usha Nandini, P. Sangeetha, R. Aroul Canessane, & Mary Livinsa Z. (2026). MULTI-MODAL TRANSFORMER ARCHITECTURE WITH CROSS-ATTENTION FUSION FOR ROBUST AUDIO-VISUAL SENTIMENT ANALYSIS. International Journal of Computer Information Systems and Industrial Management Applications, 18(11s), 1101–1112. https://doi.org/10.70917/ijcisim-2026-3834