1 paper
Shaima Ahmad Freja, Ferhat Ozgur Catak, Betul Yurdem +1
Large Language Models (LLMs) are increasingly deployed in critical applications requiring reliable reasoning, yet their internal reasoning processes remain difficult to evaluate sy…