1 paper
Xuefeng Wei, Zhixuan Wang, Xuan Zhou +5
We introduce CARTBENCH, a museum-grounded benchmark for evaluating vision-language models (VLMs) on Chinese artworks beyond short-form recognition and QA. CARTBENCH comprises four…