1 paper · 1 filter
Renzhao Liang, Jingru Chen, Bo Jia +7
Evaluating large language models (LLMs) is increasingly confounded by \emph{variant contamination}: the training corpus contains semantically equivalent yet lexically or syntactica…