1 paper
Tahreem Yasir, Sutapa Dey Tithi, Benyamin Tabarsi +7
Large language models (LLMs) are increasingly used for automated tutoring, but their reliability in structured symbolic domains remains unclear. We study step-level feedback for pr…