3 papers
cs.CV2026
Thinker: A vision-language foundation model for embodied intelligence
Baiyu Pan, Daqin Luo, Junpeng Yang +4
When large vision-language models are applied to the field of robotics, they encounter problems that are simple for humans yet error-prone for models. Such issues include confusion…
cs.CV2025
SP-Det: Self-Prompted Dual-Text Fusion for Generalized Multi-Label Lesion Detection
Qing Xu, Yanqian Wang, Xiangjian Hea +5
Automated lesion detection in chest X-rays has demonstrated significant potential for improving clinical diagnosis by precisely localizing pathological abnormalities. While recent…
cs.GT2024
IC Mechanisms for Risk-Averse Advertisers in the Online Advertising System
Bingzhe Wang, Ruohan Qian, Yuejia Dou +12
The autobidding system generates huge revenue for advertising platforms, garnering substantial research attention. Existing studies in autobidding systems focus on designing Autobi…