1 paper
Jiaxing Guo, Wenjie Yang, Shengzhong Zhang +4
Outcome-rewarded Large Language Models (LLMs) have demonstrated remarkable success in mathematical problem-solving. However, this success often masks a critical issue: models frequ…