1 paper
Xinyu Cao, Bing-Chang Wang, Ying Cao
Policy iteration (PI) is an important reinforcement learning tool for solving optimal control problems which includes an initialization stage, i.e., the search for an initial stabi…