1 paper · 1 filter
Jianheng Tang, Qifan Zhang, Yuhan Li +2
The ``arms race'' of Large Language Models (LLMs) demands new benchmarks to examine their progresses. In this paper, we introduce GraphArena, a benchmarking tool designed to evalua…