2 papers
cs.AI2025
Robust Search with Uncertainty-Aware Value Models for Language Model Reasoning
Fei Yu, Yingru Li, Benyou Wang
Value model guided search is effective in steering LLM generation but suffers from a lack of robustness. This is due to verifier failure: imperfect VMs mistakenly prune valid reaso…
cs.CL2025
Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning
Fei Yu, Yingru Li, Benyou Wang
Large language models (LLMs) struggle with multi-step reasoning, where inference-time scaling has emerged as a promising strategy for performance improvement. Verifier-guided searc…