1 paper · 1 filter
Hongtao Liu, Zhicheng Du, Zihe Wang +1
Game-playing ability serves as an indicator for evaluating the strategic reasoning capability of large language models (LLMs). While most existing studies rely on utility performan…