Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
IDEAL-Bench: Indoor Dataset and Evaluation suite for Analyzing 3D Layout reasoning
Yuening Cai, Junwei Zhou, Youran Qu +1
Spatial question answering is the dominant paradigm for evaluating spatial intelligence in Vision-Language Models (VLMs), but it leaves a complementary axis of spatial competence u…
cs.CV2024
Fréchet Video Motion Distance: A Metric for Evaluating Motion Consistency in Videos
Jiahe Liu, Youran Qu, Qi Yan +3
Significant advancements have been made in video generative models recently. Unlike image generation, video generation presents greater challenges, requiring not only generating hi…