1 paper · 1 filter
Laura Dietz, Oleg Zendel, Peter Bailey +6
Large Language Models (LLMs) are increasingly used to evaluate information retrieval (IR) systems, generating relevance judgments traditionally made by human assessors. Recent empi…