1 paper · 1 filter
Denica Kjorvezir, Marko DjukanoviÄ, Ana Gjorgjevikj +2
Evaluating large language models (LLMs) across comprehensive benchmarks is expensive and time-consuming. We propose a graph-based prompt selection framework that models each benchm…