2 papers
cs.RO2026
R2S-Eval: Robot Evaluation with Real-to-Sim Calibration via Vision-Language Models
Yidi Wang, Feixiang Ruan, Ruoqu Chen +4
Evaluating robot manipulation policies is becoming increasingly important as generalist models, particularly vision-language-action (VLA) models, are deployed on physical robots. H…
cs.RO2026
Operational digital twin clinics enable task-based evaluation of embodied AI
Xinyuan Wu, Jingrao Zhang, Mengdi Xu +3
Embodied artificial intelligence (AI) must be tested in the clinical environments where it will operate, but building realistic, robot-testable settings is costly and difficult to…