Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Task Specialization Fine-Tuning for Contextual Reinforcement Learning
Jianan Zhou, Jung-Hoon Cho, Tianyue Zhou +5
Contextual Reinforcement Learning (CRL) seeks to generalize classical RL by maximizing task coverage across a context space of related tasks. While prior works often train from scr…
cs.LG2026
Internalizing Curriculum Judgment for LLM Reinforcement Fine-Tuning
Han Zheng, Yining Ma, Karthick Gunasekaran +4
In LLM Reinforcement Fine-Tuning (RFT), curriculum learning drives both efficiency and performance. Yet, current methods externalize curriculum judgment via handcrafted heuristics…