3 papers
cs.CV2025
Structures Meet Semantics: Multimodal Fusion via Graph Contrastive Learning
Jiangfeng Sun, Sihao He, Zhonghong Ou +1
Multimodal sentiment analysis (MSA) aims to infer emotional states by effectively integrating textual, acoustic, and visual modalities. Despite notable progress, existing multimoda…
cs.DB2025
SQL-o1: A Self-Reward Heuristic Dynamic Search Method for Text-to-SQL
Shuai Lyu, Haoran Luo, Ripeng Li +6
Text-to-SQL (Text2SQL) aims to map natural language questions to executable SQL queries. Although large language models (LLMs) have driven significant progress, current approaches…
cs.CV2025
TSVC:Tripartite Learning with Semantic Variation Consistency for Robust Image-Text Retrieval
Shuai Lyu, Zijing Tian, Zhonghong Ou +5
Cross-modal retrieval maps data under different modality via semantic relevance. Existing approaches implicitly assume that data pairs are well-aligned and ignore the widely existi…