2 papers
cs.AI2026
WISE: A Long-Horizon Agent in Minecraft with Why-Which Reasoning
Renmin Cheng, Changhao Chen
Rapid advances have been made in developing general-purpose embodied agent in environments like Minecraft through the adoption of LLM-augmented hierarchical approaches. Despite the…
cs.DC2025
Role-Based Fault Tolerance System for LLM RL Post-Training
Zhenqian Chen, Baoquan Zhong, Xiang Li +6
RL post-training for LLMs has been widely scaled to enhance reasoning and tool-using capabilities. However, RL post-training interleaves training and inference workloads, exposing…