1 paper · 1 filter
Jiakun Li, Xingwei He, Kefan Li +3
Test-time scaling improves the reasoning performance of large language models but often results in token-inefficient overthinking, where models continue reasoning beyond what is ne…