1 paper · 1 filter
Jozef Kubík, Marek Šuppa, Martin Takáč
Limited data for low-resource languages typically yield weaker language models (LMs). Since pre-training is compute-intensive, it is more pragmatic to target improvements during fi…