1 paper
Timur Turatali, Aida Turdubaeva, Rustem Izmailov +2
Evaluating large language models (LLMs) across languages remains challenging, as most multilingual benchmarks rely on translated English datasets, often obscuring linguistic and cu…