1 paper · 1 filter
Kainat Riaz, Muhammad Ahmed Mohsin, Ahsan Bilal +5
Automated scientific discovery using large language models relies on identifying genuinely novel solutions. Standard reinforcement learning penalizes high-variance mutations, which…