1 paper
Ruhallah Niazi, Faeze Ghorbanpour, Alexander Fraser
Despite impressive multilingual capabilities, large language models (LLMs) remain poorly evaluated on literary knowledge in non-English languages. We introduce PersLitEval, a bench…