2 papers
cs.CV2026
Rethinking Text-Based Image Retrieval in Specific Domain
Jingyang Tan, Sheng Yang, Yuanpeng Chen +4
Driven by the rapid advancement of vision-language representation learning, Text-based Image Retrieval (TBIR) has made notable progress. However, existing benchmarks are predominan…
cs.CL2026
Know2Guess: A Contamination-Aware Multi-Zone Benchmark for Knowledge-Boundary Evaluation in Large Language Models
Renwei Meng, Bowen Zhang, Jian Wang +4
Reliable evaluation of large language models should separate supported answering from unsupported guessing without conflating either with data contamination, prompt idiosyncrasy, o…