1 paper
Yunsu Kim, Kaden Uhlig, Joern Wuebker
Agent benchmarks remain largely English-centric, while their multilingual versions are often built with machine translation (MT) and limited post-editing. We argue that, for agenti…