Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning
Runze Zhao, Dongruo Zhou, Sumit Kumar Jha +2
Cooperative multi-agent reinforcement learning (MARL) often relies on communication to mitigate partial observability, yet most existing protocols treat messages as flat dense vect…
cs.AI2026
Automatic Dataset Construction (ADC): Sample Collection, Data Curation, and Beyond
Minghao Liu, Zonglin Di, Jiaheng Wei +15
Large-scale data collection is essential for developing personalized training data, mitigating the shortage of training data, and fine-tuning specialized models. However, creating…