2 papers
math.OC2026
Inverse reinforcement learning for indefinite mean-field social optimization with multiplicative noise
Ying Cao, Xun Li, Bing-Chang Wang
This paper studies the inverse reinforcement learning (RL) problem for linear-quadratic mean-field (MF) social optimization. The considered system features multiplicative noise and…
math.OC2026
Stabilizer Design for Policy Iteration in Stochastic Linear Quadratic Control: A Spectrum-Assignment Approach
Xinyu Cao, Bing-Chang Wang, Ying Cao
Policy iteration (PI) is an important reinforcement learning tool for solving optimal control problems which includes an initialization stage, i.e., the search for an initial stabi…