Showing cs.CVShow all
3 papers · 1 filter
cs.CV2025
LuciBot: Automated Robot Policy Learning from Generated Videos
Xiaowen Qiu, Yian Wang, Jiting Cai +4
Automatically generating training supervision for embodied tasks is crucial, as manual designing is tedious and not scalable. While prior works use large language models (LLMs) or…
cs.CV2024
Architect: Generating Vivid and Interactive 3D Scenes with Hierarchical 2D Inpainting
Yian Wang, Xiaowen Qiu, Jiageng Liu +6
Creating large-scale interactive 3D environments is essential for the development of Robotics and Embodied AI research. Current methods, including manual design, procedural generat…
cs.CV2024
Take A Step Back: Rethinking the Two Stages in Visual Reasoning
Mingyu Zhang, Jiting Cai, Mingyu Liu +3
Visual reasoning, as a prominent research area, plays a crucial role in AI by facilitating concept formation and interaction with the world. However, current works are usually carr…