2 papers
cs.RO2025
Continuous Vision-Language-Action Co-Learning with Semantic-Physical Alignment for Behavioral Cloning
Xiuxiu Qi, Yu Yang, Jiannong Cao +4
Language-conditioned manipulation facilitates human-robot interaction via behavioral cloning (BC), which learns control policies from human demonstrations and serves as a cornersto…
cs.RO2025
Structured Task Solving via Modular Embodied Intelligence: A Case Study on Rubik's Cube
Chongshan Fan, Shenghai Yuan
This paper presents Auto-RubikAI, a modular autonomous planning framework that integrates a symbolic Knowledge Base (KB), a vision-language model (VLM), and a large language model…