1 paper
Lizhuo Zhang, Mengmeng Tang, Chenfeng Long +2
Majority voting over multiple LLM samples is widely used to raise answer accuracy, yet its gain varies erratically: on hard questions it can even backfire. This paper gives a quant…