1 paper
Ke Zhang, Xiaoning Zhao, Ce Zheng +5
This study proposes Tool-RoCo, a novel benchmark for evaluating large language models (LLMs) in long-term multi-agent cooperation based on RoCo, a multi-robot cooperative benchmark…