Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
AgentJet: A Distributed Swarm Training Framework for Agentic Reinforcement Learning
Qingxu Fu, Boyin Liu, Shuchang Tao +5
Training reinforcement learning (RL) policies for large language model (LLM) agents requires optimizing multi-turn trajectories that interact with external environments. Existing t…
cs.AI2025
CuES: A Curiosity-driven and Environment-grounded Synthesis Framework for Agentic RL
Shinji Mai, Yunpeng Zhai, Ziqian Chen +5
Large language model based agents are increasingly deployed in complex, tool augmented environments. While reinforcement learning provides a principled mechanism for such agents to…