1 paper · 1 filter
Ming Liu, Wensheng Zhang
Multimodal Large Language Models (MLLMs) show impressive vision-language benchmark performance, yet growing concerns about data contamination (test set exposure during training) ri…