1 paper · 1 filter
Edoardo Zorzi, Alberto Castellini, Leonidas Bakopoulos +2
Most offline RL algorithms return optimal policies but do not provide statistical guarantees on desirable behaviors. This could generate reliability issues in safety-critical appli…