1 paper
Tristan Cinquin, Geoff Pleiss, Agustinus Kristiadi
While chain-of-thought prompting with Best-of-N (BoN) selection has become popular for mathematical reasoning in large language models (LLMs), its linear structure fails to capture…