1 paper
Rongjun Chen, Chengsi Yao, Jinchang Ren +6
Text-image alignment constitutes a foundational challenge in multimedia content understanding, where effective modeling of cross-modal semantic correspondences critically enhances…