1 paper
Matéo Mahaut, Marco Baroni
Recent literature suggests that the bigger the model, the more likely it is to converge to similar, ``universal'' representations, despite different training objectives, datasets,…