1 paper
Qiannian Zhao, Chen Yang, Jinhao Jing +5
Large reasoning models (LRMs) have emerged as a powerful paradigm for solving complex real-world tasks. In practice, these models are predominantly trained via Reinforcement Learni…