1 paper
Shuo Liu, Tianle Chen, Ryan Amiri +1
Recent work has explored optimizing LLM collaboration through Multi-Agent Reinforcement Learning (MARL). However, most MARL fine-tuning approaches rely on predefined execution prot…