1 paper
Ekaterina Trofimova, Zosia Shamina, Maria Selifanova +7
We introduce ML2B, the first benchmark for evaluating cross-lingual task comprehension in end-to-end ML pipeline generation by large language models. Despite growing global AI adop…