1 paper
Jiarui Hu, Zhiyuan Wen, Xiaoyun Liu +2
Large reasoning models often produce reasoning traces with verification, revision, and backtracking. When reflection merely re-checks established results, it wastes reasoning token…