1 paper
Yibin Liu, Zhixuan Liang, Zanxin Chen +7
Recent advances in multimodal large language models (MLLMs) have enabled richer perceptual grounding for code policy generation in embodied agents. However, most existing systems l…