1 paper
Jeanmely Rojas Nunez, Viraj Sawant, Nathan Allen +4
Fine-tuning large language models (LLMs) frequently induces catastrophic forgetting of prior capabilities. Recent work has shown that reinforcement learning (RL) retains prior capa…