2 papers
cs.MA2026
CCKS: Consensus-based Communication and Knowledge Sharing
Jinyuan Zu, Xiaowei Lv, Yongcai Wang +5
In Decentralized Training and Decentralized Execution (DTDE) for cooperative Multi-Agent Reinforcement Learning (MARL), action-advising-based knowledge sharing promotes interpretab…
cs.AI2026
DecisionLLM: Large Language Models for Long Sequence Decision Exploration
Xiaowei Lv, Zhilin Zhang, Yijun Li +10
Long-sequence decision-making, which is usually addressed through reinforcement learning (RL), is a critical component for optimizing strategic operations in dynamic environments,…