1 paper · 1 filter
Rikuto Kotoge, Mai Nishimura, Jiaxin Ma
Reinforcement Learning has emerged as a dominant post-training approach to elicit agentic RAG behaviors such as search and planning from language models. Despite its success with l…