1 paper
Madison Van Doren, Casey Ford, Jennifer Barajas +2
We present a large-scale human evaluation benchmark for assessing cultural localisation in machine translation produced by state-of-the-art multilingual large language models (LLMs…