1 paper · 1 filter
Alireza Salemi, Julian Killingback, Hamed Zamani
Evaluating personalized text generated by large language models (LLMs) is challenging, as only the LLM user, i.e., prompt author, can reliably assess the output, but re-engaging th…