Showing cs.CVShow all
3 papers · 1 filter
cs.CV2025
MedCutMix: A Data-Centric Approach to Improve Radiology Vision-Language Pre-training with Disease Awareness
Sinuo Wang, Yutong Xie, Yuyuan Liu +1
Vision-Language Pre-training (VLP) is drawing increasing interest for its ability to minimize manual annotation requirements while enhancing semantic understanding in downstream ta…
cs.CV2024
A Survey of Medical Vision-and-Language Applications and Their Techniques
Qi Chen, Ruoshan Zhao, Sinuo Wang +9
Medical vision-and-language models (MVLMs) have attracted substantial interest due to their capability to offer a natural language interface for interpreting complex medical data.…
cs.CV2024
Improving Online Source-free Domain Adaptation for Object Detection by Unsupervised Data Acquisition
Xiangyu Shi, Yanyuan Qiao, Qi Wu +2
Effective object detection in autonomous vehicles is challenged by deployment in diverse and unfamiliar environments. Online Source-Free Domain Adaptation (O-SFDA) offers model ada…