1 paper · 1 filter
Fei Yu, Yingru Li, Benyou Wang
Large language models (LLMs) struggle with multi-step reasoning, where inference-time scaling has emerged as a promising strategy for performance improvement. Verifier-guided searc…