2 papers
eess.IV2026
BreastMammo and DenseMammo: Benchmarks for Mammography Domain Generalization
Hongyi Pan, Gorkem Durak, Halil Ertugrul Aktas +18
Breast density classification is a critical component of breast cancer risk assessment, yet AI models often struggle to generalize across clinical sites due to vendor-specific acqu…
cs.CV2026
SPARC-Rad: A Multimodal Benchmark Dataset and Evaluation Pipeline for Spatial and Anatomical Reasoning in Radiology Vision-Language Models
Satvik Tripathi, Mustafa Ege Seker, Kristian Quevada +8
Vision-language models (VLMs) are increasingly being evaluated for medical imaging, but many available benchmarks emphasize disease classification, report generation, or broad visu…