1 paper
Laura Zeidler, Juri Opitz, Anette Frank
Evaluating the quality of generated text is difficult, since traditional NLG evaluation metrics, focusing more on surface form than meaning, often fail to assign appropriate scores…