1 paper · 1 filter
Long Zhang, Wei-neng Chen, Feng-feng Wei +1
Language models often generate reasoning before giving a final answer, but the visible answer does not reveal when the model's answer preference became stable. We study this questi…