1 paper
Rohit K. Dubey, Damian Dailisan, Sachit Mahajan
We present an ethical decision-making framework that refines a pre-trained reinforcement learning (RL) model using a task-agnostic ethical layer. Following initial training, the RL…