1 paper
Jinliang Gao, Ning Yang, Hai Wang +2
The paper introduces SDO, a plug‑and‑play framework that dynamically organizes training data for large language model post‑training by using exposure‑driven feedback and K‑nearest‑…