1 paper
Nazanin Jafari, James Allan, Mohit Iyyer
Evaluating the factuality of long-form output generated by large language models (LLMs) remains challenging, particularly when responses are open-ended and contain many fine-graine…