1 paper · 1 filter
Ashish Jha, Valentin Leplat, AH Phan
Training large language models on massive datasets is computationally expensive, yet empirical evidence suggests that substantial portions of training examples contribute minimally…