1 paper · 1 filter
Yongqiang Ma, Lizhi Qing, Jiawei Liu +5
Evaluating large language models (LLMs) is fundamental, particularly in the context of practical applications. Conventional evaluation methods, typically designed primarily for LLM…