1 paper · 1 filter
Lukáš Eigler, JindÅich Libovický, David Hurych
Validating evaluation metrics for NLG typically relies on expensive and time-consuming human annotations, which predominantly exist only for English datasets. We propose LLM as a M…