1 paper
Wenxuan Jiang, Yuxin Zuo, Zijian Zhang +8
In-Context Reinforcement Learning (ICRL) enables Large Language Models (LLMs) to learn online from external rewards directly within the context window. However, a central challenge…