1 paper
Haotong Yang, Zitong Wang, Shijia Kang +7
While large language models (LLMs) have achieved strong performance on mathematical problems with verifiable answers, many advanced problems are proof-based and require evaluating…