1 paper · 1 filter
Bintao Tang, Xin Yang, Yuhao Wang +3
We present INTEGRALBENCH, a focused benchmark designed to evaluate Large Language Model (LLM) performance on definite integral problems. INTEGRALBENCH provides both symbolic and nu…