1 paper
Sanghee J. Kim, Kanishka Misra
Evaluating the naturalness of dialogue in language models (LMs) is not trivial: notions of 'naturalness' vary, and scalable quantitative metrics remain limited. This study leverage…