1 paper · 1 filter
Sophia Xiao Pu, Yumo Xu, Sailik Sengupta +5
Inference-time decoding methods improve LLM reasoning by exploring multiple candidate trajectories, yet treat each trajectory as atomic: either retaining it whole or discarding it…