1 paper
Aadirupa Saha, Aniket Wagde, Branislav Kveton
LLM-as-a-judge has emerged as a cornerstone technique for evaluating large language models by leveraging LLM reasoning to score prompt-response pairs. Since LLM judgments are stoch…