1 paper
Jiangnan Li, Thuy-Trang Vu, Christian Herold +3
Naive joint training of large language models (LLMs) for multilingual preference alignment can suffer from negative interference. This is a known issue in multilingual training, wh…