1 paper
Shikhar Shiromani, Archie Chaudhury, Sri Pranav Kunda
Large Language Models (LLMs) frequently exhibit unfaithful behavior, producing a final answer that differs significantly from their internal chain of thought (CoT) reasoning in ord…