1 paper
Ashish Jha, Valentin Leplat, AH Phan
Training large language models on massive datasets is computationally expensive, yet empirical evidence suggests that substantial portions of training examples contribute minimally…