2 papers
cs.RO2026
CREST: Constraint-Release Execution for Multi-Robot Warehouse Shelf Rearrangement
Jiaqi Tan, Yudong Luo, Sophia Huang +2
Double-Deck Multi-Agent Pickup and Delivery (DD-MAPD) models the multi-robot shelf rearrangement problem in automated warehouses. MAPF-DECOMP is a recent framework that first compu…
cs.LG2025
Measures of Variability for Risk-averse Policy Gradient
Yudong Luo, Yangchen Pan, Jiaqi Tan +1
Risk-averse reinforcement learning (RARL) is critical for decision-making under uncertainty, which is especially valuable in high-stake applications. However, most existing works f…