1 paper · 1 filter
Tianyu Ding, Aditya Nannapaneni, Juan Pablo De la Cruz Weinstein
Practice often treats automatic metrics for attribution in LLM retrieval-augmented generation as interchangeable. We audit eight automatic scorers -- lexical, embedding, and BERTSc…