1 paper
Zhongmou He, Yee Man Choi, Kexun Zhang +6
Verifiers play a crucial role in large language model (LLM) reasoning, needed by post-training techniques such as reinforcement learning. However, reliable verifiers are hard to ge…