3 papers
cs.RO2026
Dex-X: Learning Visual-Tactile Dexterous Manipulation From Human Videos with Simulated Interaction
Ruoqu Chen, Feixiang Ruan, Liu Cao +9
Human videos are an abundant source of dexterous manipulation behaviors, but they lack tactile information that is crucial for contact-rich interaction. This raises a fundamental q…
cs.RO2025
Queryable 3D Scene Representation: A Multi-Modal Framework for Semantic Reasoning and Robotic Task Planning
Xun Li, Rodrigo Santa Cruz, Mingze Xi +9
To enable robots to comprehend high-level human instructions and perform complex tasks, a key challenge lies in achieving comprehensive scene understanding: interpreting and intera…
cs.CV2023
Real-time Multi-modal Object Detection and Tracking on Edge for Regulatory Compliance Monitoring
Jia Syuen Lim, Ziwei Wang, Jiajun Liu +4
Regulatory compliance auditing across diverse industrial domains requires heightened quality assurance and traceability. Present manual and intermittent approaches to such auditing…