Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Bellman-Taylor Score Decoding for Markov Decision Processes with State-Dependent Feasible Action Sets
Yi Chen, Rushuai Yang, Qiang Chen +2
Many Markov decision processes (MDPs) in operations research have feasible actions that are state dependent and defined implicitly by various operational constraints. These feature…
cs.AI2026
ConMem: Structured Memory-Guided Adaptation in Training-Free Multi-Agent Systems
Zhixun Tan, Qiang Chen, Tairan Huang +2
Recent advances have improved the adaptive capabilities of LLM-based multi-agent systems (MAS) through memory-, skill-, and learning-based approaches, yet these approaches remain c…