1 paper · 1 filter
Yuxuan Liu, Tianchi Yang, Shaohan Huang +6
Large language models (LLMs) have emerged as a promising alternative to expensive human evaluations. However, the alignment and coverage of LLM-based evaluations are often limited…