2 papers
cs.LG2026
Mitigating Overthinking in Large Reasoning Models via Difficulty-aware Reinforcement Learning
Qian Wan, Ziao Xu, Luona Wei +2
Large Reasoning Models (LRMs) achieve explicit chain-of-thought expansion by imitating deep thinking behaviors of humans, demonstrating excellent performance in complex task scenar…
cs.LG2026
Beyond Error-Based Optimization: Experience-Driven Symbolic Regression with Goal-Conditioned Reinforcement Learning
Jianwen Sun, Xinrui Li, Fuqing Li +1
Symbolic Regression aims to automatically identify compact and interpretable mathematical expressions that model the functional relationship between input and output variables. Mos…