1 paper · 1 filter
Dane Williamson, Yangfeng Ji, Matthew Dwyer
Large Language Models (LLMs) demonstrate strong mathematical problem-solving abilities but frequently fail on problems that deviate syntactically from their training distribution.…