1 paper · 1 filter
Zhiliang Chen, Alfred Wei Lun Leong, Shao Yong Ong +6
Co-optimizing data and model configurations for training LLMs presents a classic chicken-and-egg dilemma: The best training data configuration (e.g., data mixture) for a downstream…