1 paper · 1 filter
Ahmed Karim, Fatima Sheaib, Zein Khamis +3
Large language models can follow complex procedures yet fail at a seemingly trivial final step: reporting a value they themselves computed moments earlier. We study this phenomenon…