Open access
Aug 2026
Bridging Visual and Textual Cues: Cross-Attention Fusion for Multi-Modal Sentiment Analysis
A hybrid Deep Auto-Encoding with Convolutional Neural Networks (DAE+CNN) is presented, a multi-modal technique based on cross-attention based multi-modal fusion model for text and visuals that outperforms single-modal sentiment analysis.
M. Yuvaraja, Dr. C. Kumuthini
· Journal of Intelligent Decis... · 0 citations