1 paper
Wenwen Xie, Gray Gwizdz, Dongji Feng
While Large Language Models (LLMs) have emerged as promising tools for evaluating Natural Language Generation (NLG) tasks, their effectiveness is limited by their inability to appr…