1 paper
Maximilian Schall, Sedigheh Eslami, Markus Krimmel +4
Evaluating first-stage retrievers in large-scale production RAG requires a benchmark that pairs a large-scale corpus with a large set of agent-reformulated search queries based on…