collaborators

6 papers

cs.RO2026

TemporalFlow-VLA: Learning Physically Grounded Execution History for Long-Horizon Robot Manipulation

Jiarui Yang, Yehao Lu, Yuning Su +9

Vision-language-action (VLA) models leverage pretrained vision-language representations for robot control, yet simply adding historical frames does not reliably capture recent phys…

cs.CV2026

V-Link: Recovering Lost Visual Representations in Action DiT for Vision-Language-Action Models

Yehao Lu, Jiarui Yang, Yuning Su +10

Vision-language-action (VLA) models provide a scalable path toward generalist robotic manipulation by integrating visual perception, language understanding, and continuous action c…

cs.RO2026

Multi-View Unified Camera Fields: Geometry-Shaped Action-Facing Representations for RGB-Only Multi-Camera VLA Policies

Jiarui Yang, Yehao Lu, Yuning Su +9

Vision-Language-Action (VLA) models have shown strong generalization in robotic manipulation, yet complex contact-rich tasks often benefit from multi-camera observations that joint…

cs.AI2026

Baichuan-M4: A Clinical-Grade Medical Agent System for Continuous Care

Aiyuan Yang, Canbin Piao, Chengfeng Dou +25

Baichuan-M4 is Baichuan Intelligence's clinical-grade medical large model, designed for continuous care rather than single-turn medical question answering. It is built as a coordin…

cs.RO2026

CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding

Chenyang Ma, Kai Lu, Guangyu Yang +6

Current work on robot failure detection and correction typically operates in a post hoc manner, analyzing errors and applying corrections only after failures occur. This work intro…

cs.RO2025

COOPERA: Continual Open-Ended Human-Robot Assistance

Chenyang Ma, Kai Lu, Ruta Desai +3

To understand and collaborate with humans, robots must account for individual human traits, habits, and activities over time. However, most robotic assistants lack these abilities,…