1 paper · 1 filter
Yiqun T Chen, Sizhu Lu, Sijia Li +2
Large language models (LLMs) are increasingly used as automatic evaluators of generative AI outputs, a paradigm often referred to as "LLM-as-a-judge." In practice, LLM judges are i…