1 paper
Sayak Mukherjee, Samrat Chatterjee, Emilie Purvine +2
Designing rewards for autonomous cyber attack and defense learning agents in a complex, dynamic environment is a challenging task for subject matter experts. We propose a large lan…