1 paper
Woosung Koh, Jeyoung Jeon, Youngjin Song +4
Current language model training commonly applies multi-task Supervised Fine-Tuning (SFT) using a homogeneous compute budget across all sub-datasets. This approach is fundamentally…