1 paper
Fabian Drexel, Marlene Fritzsche, Era Stambollxhiu +15
Vision-language pretraining learns rich medical image representations from radiology reports, but previous model variants commonly operate within a single shared embedding space, s…