1 paper · 1 filter
Soheil Abbasloo
What does it truly mean for a language model to "reason"? Current evaluations reward models' correct standalone answers-but correctness alone reveals little about the process that…