1 paper · 1 filter
Fabian Drexel, Marlene Fritzsche, Era Stambollxhiu +15
Vision-language pretraining learns rich medical image representations from radiology reports, but previous model variants commonly operate within a single shared embedding space, s…