2 papers
cs.AI2026
Phase-Aware Guidance Injection for Recurrent MAPPO in Assembly-Line Disruption Recovery
Xin Huang, Yongcai Wang, Fengyi Zhang +3
Disruption recovery in industrial assembly lines requires timely decisions under machine faults, worker absence, and emergency orders. Existing methods either rely on rigid handcra…
cs.MA2026
CCKS: Consensus-based Communication and Knowledge Sharing
Jinyuan Zu, Xiaowei Lv, Yongcai Wang +5
In Decentralized Training and Decentralized Execution (DTDE) for cooperative Multi-Agent Reinforcement Learning (MARL), action-advising-based knowledge sharing promotes interpretab…