1 paper · 1 filter
Zhengyu Chen, Yudong Wang, Teng Xiao +5
Recent advancements in improving the reasoning capabilities of Large Language Models have underscored the efficacy of Process Reward Models (PRMs) in addressing intermediate errors…