1 paper
Aleksei Dorkin, Taido Purason, Emil Kalbaliyev +9
Large language models (LLMs) are predominantly trained on English-centric data, resulting in uneven performance for smaller languages. We study whether continued pretraining (CPT)…