large language models 3autonomous agents 1benchmarking 1contrastive learning 1feedback-driven policy discovery 1generative recommendation 1intent modeling 1knowledge distillation 1long-horizon reasoning 1multi-step reasoning 1online inference 1process evaluation 1
From the 3 of 11 linked papers with an AI index.
Showing cs.CVShow all
3 papers · 1 filter
cs.CV2025
VisuRiddles: Fine-grained Perception is a Primary Bottleneck for Multimodal Large Language Models in Abstract Visual Reasoning
Hao Yan, Xingchen Liu, Hao Wang +11
Recent strides in multimodal large language models (MLLMs) have significantly advanced their performance in many reasoning tasks. However, Abstract Visual Reasoning (AVR) remains a…
cs.CV2025
TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation
Hongxiang Zhao, Xingchen Liu, Mutian Xu +3
We address key limitations in existing datasets and models for task-oriented hand-object interaction video generation, a critical approach of generating video demonstrations for ro…
cs.CV2025
UnCommon Objects in 3D
Xingchen Liu, Piyush Tayal, Jianyuan Wang +10
We introduce Uncommon Objects in 3D (uCO3D), a new object-centric dataset for 3D deep learning and 3D generative AI. uCO3D is the largest publicly-available collection of high-reso…