1 paper
Jinghui Wang, Shaojie Wang, Yinghan Cui +9
Agentic large language model (LLM) training often involves multi-turn interaction trajectories that branch into multiple execution paths due to concurrent tool use, think-mode, sub…