1 paper
Logan Lawrence, Ashton Williamson, Alexander Shelton
As large-language models have been increasingly used as automatic raters for evaluating free-form content, including document summarization, dialog, and story generation, work has…