1 paper
Sweta Karlekar, Carolina Zheng, Magnus Saebo +5
Many applications seek to optimize LLM outputs at test time by iteratively proposing, scoring, and refining candidates over a discrete output space. Existing methods use a calibrat…