1 paper
Xiaonan Wang, Jinyoung Yeo, Joon-Ho Lim +1
Large language models have exhibited significant enhancements in performance across various tasks. However, the complexity of their evaluation increases as these models generate mo…