Showing cs.CVShow all
2 papers · 1 filter
cs.CV2024
Multi-modal Situated Reasoning in 3D Scenes
Xiongkun Linghu, Jiangyong Huang, Xuesong Niu +3
Situation awareness is essential for understanding and reasoning about 3D scenes in embodied AI agents. However, existing datasets and benchmarks for situated understanding are lim…
cs.CV2023
An Embodied Generalist Agent in 3D World
Jiangyong Huang, Silong Yong, Xiaojian Ma +7
Leveraging massive knowledge from large language models (LLMs), recent machine learning models show notable successes in general-purpose task solving in diverse domains such as com…