1 paper
Shuying Xu, Junjie Hu, Ming Jiang
The conventional paradigm of using large language models (LLMs) for natural language generation (NLG) evaluation relies on pre-defined task definitions and evaluation criteria, pos…