Showing cs.LGShow all
2 papers · 1 filter
cs.LG2025
Dynamic Loss-Based Sample Reweighting for Improved Large Language Model Pretraining
Daouda Sow, Herbert Woisetschläger, Saikiran Bulusu +3
Pretraining large language models (LLMs) on vast and heterogeneous datasets is crucial for achieving state-of-the-art performance across diverse downstream tasks. However, current…
cs.LG2024
Algorithm Design for Online Meta-Learning with Task Boundary Detection
Daouda Sow, Sen Lin, Yingbin Liang +1
Online meta-learning has recently emerged as a marriage between batch meta-learning and online learning, for achieving the capability of quick adaptation on new tasks in a lifelong…