1 paper · 1 filter
Lin Sun, Chuang Liu, Xiaofeng Ma +3
Recent advancements in Large Language Models (LLMs) have demonstrated that Process Reward Models (PRMs) play a crucial role in enhancing model performance. However, training PRMs t…