1 paper · 1 filter
Chao Deng, Shaolei Zhang, Ju Fan +1
High-quality training data is essential to large language models (LLMs) and typically requires extensive and costly manual curation. Existing automatic data preparation methods rel…