1 paper · 1 filter
Meng Wang, Haohan Zhao, Wenzhuo Liu +7
Continual post-training enables foundation models to acquire new knowledge while preserving existing capabilities. Recent work suggests that on-policy learning can mitigate forgett…