1 paper
Abi Aryan, Zac Liu, Aaron Childress
Agents trained with reinforcement learning often develop brittle policies that fail when dynamics shift, a problem amplified by static benchmarks. AbideGym, a dynamic MiniGrid wrap…