1 paper
Junjie Chen, Yuxi Dong, Haitao Li +6
As large language models (LLMs) are increasingly used for long-form generation, reliably evaluating long-form outputs has become a critical challenge. LLM-as-a-judge offers a scala…