1 paper
Tianhong Zhou, Yin Xu, Yingtao Zhu +4
Vision-language models (VLMs) exhibit strong zero-shot generalization on natural images and show early promise in interpretable medical image analysis. However, existing benchmarks…