1 paper
Yiming Gai, Junde Lu, Xuefei Huang
The remarkable performance of large language models (LLMs) in linguistic tasks underscores an urgent need for comprehensive evaluation of their response quality. Prevailing methods…