1 paper
Olivier Goudet, Quentin Suire, Adrien Goëffon +2
We introduce an order-invariant reinforcement learning framework for black-box combinatorial optimization. Classical estimation-of-distribution algorithms (EDAs) often rely on lear…