1 paper
Shengtian Yang, Ziyu Xiong, Yu Li +3
Multi-agent large language models solve complex tasks by coordinating several policies in a shared environment. However, existing reinforcement learning methods usually optimize ea…