3 papers
cs.AI2026
PCSD: Persistent Consistency for Self-Distillation in Agentic Reinforcement Learning
Chunji Lv, Yangguang Wei, Junlin Liu +6
Large language model agents have shown strong potential in complex interactive tasks, yet their reinforcement learning (RL) is often hindered by sparse rewards, as a long multi-tur…
cs.AI2026
Evolutionary Enhanced Multi-Agent Reinforcement Learning for Cooperative Air Combat
Chengwei Li, Junlin Liu, Yang Gao
As modern air combat evolves toward beyond-visual-range (BVR) multi-aircraft cooperative engagements, autonomous decision-making for unmanned combat aerial vehicles (UCAVs) faces s…
cs.AI2026
OpenGuanDan: A Large-Scale Imperfect Information Game Benchmark
Chao Li, Shangdong Yang, Chiheng Zhan +5
The advancement of data-driven artificial intelligence (AI), particularly machine learning, heavily depends on large-scale benchmarks. Despite remarkable progress across domains ra…