3 papers
cs.LG2026
Probing Dec-POMDP Reasoning in Cooperative MARL
Kale-ab Tessera, Leonard Hinckeldey, Riccardo Zamboni +2
Cooperative multi-agent reinforcement learning (MARL) is typically framed as a decentralised partially observable Markov decision process (Dec-POMDP), a setting whose hardness stem…
cs.LG2026
Forgetting is Everywhere
Ben Sanati, Thomas L. Lee, Trevor McInroe +5
A fundamental challenge in developing general learning algorithms is their tendency to forget past knowledge as they adapt to new data. Addressing this problem requires a principle…
cs.LG2025
Remembering the Markov Property in Cooperative MARL
Kale-ab Abebe Tessera, Leonard Hinckeldey, Riccardo Zamboni +2
Cooperative multi-agent reinforcement learning (MARL) is typically formalised as a Decentralised Partially Observable Markov Decision Process (Dec-POMDP), where agents must reason…