Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
VisualNeedle: Benchmarking Active Visual Search in Information-Dense Scenes
Jingru Chen, Yiming Liu, Mingtao Chen +5
Frontier multimodal large language models (MLLMs) have been reported to achieve over 90% accuracy on fine-grained perception benchmarks. However, such scores do not necessarily imp…
cs.CV2025
Q-Save: Towards Scoring and Attribution for Generated Video Evaluation
Xiele Wu, Zicheng Zhang, Mingtao Chen +7
Evaluating AI-generated video (AIGV) quality hinges on three crucial dimensions: visual quality, dynamic quality, and text-video alignment. While numerous evaluation datasets and a…