1 paper
Sureyya Akin, Kavita Srivastava, Prateek B. Kapoor +3
Learning cooperative multi-agent policies directly from high-dimensional, multimodal sensory inputs like pixels and audio (from pixels) is notoriously sample-inefficient. Model-fre…