1 paper · 1 filter
Sanjeda Akter, Ibne Farabi Shihab, Anuj Sharma
Large language models can produce correct answers while relying on flawed reasoning traces, partly because common training objectives reward final-answer correctness rather than fa…