1 paper · 1 filter
Aditya Narendra, Dmitry Makarov, Aleksandr Panov
We introduce Massively Multi-Task Model-Based Policy Optimization (M3PO), a scalable model-based reinforcement learning (MBRL) framework designed to address sample inefficiency in…