1 paper
Yiqun T Chen, Sizhu Lu, Sijia Li +2
Large language models (LLMs) are increasingly used as automatic evaluators of generative AI outputs, a paradigm often referred to as "LLM-as-a-judge." In practice, LLM judges are i…