Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
Towards Efficient LLMs Annealing with Principled Sample Selection
Yuanjian Xu, Jianing Hao, Wanbo Zhang +2
The annealing phase is a pivotal convergence stage in LLM pre-training that ultimately determines final model quality. However, effectively selecting training data during this phas…
cs.CL2026
D: Dynamic Directional Graph-Constrained Data Scheduling for LLM Training
Yuanjian Xu, Jianing Hao, Guang Zhang +1
Training data plays a central role in large language models (LLMs) optimization, motivating extensive research on data scheduling strategies. Most existing approaches concentrate o…