B. Ankayarkanni, D. Usha Nandini, P. Sangeetha, R. Aroul Canessane, and Mary Livinsa Z. 2026. “MULTI-MODAL TRANSFORMER ARCHITECTURE WITH CROSS-ATTENTION FUSION FOR ROBUST AUDIO-VISUAL SENTIMENT ANALYSIS”. International Journal of Computer Information Systems and Industrial Management Applications 18 (11s):1101-12. https://doi.org/10.70917/ijcisim-2026-3834.