2 papers
cs.LG2026
A Multi-Fidelity Control Variate Approach for Policy Gradient Estimation
Xinjie Liu, Cyrus Neary, Kushagra Gupta +4
Many reinforcement learning (RL) algorithms are impractical for training in operational systems or computationally expensive high-fidelity simulations, as they require large amount…
cs.AI2026
Foundation Models for Logistics: Toward Certifiable, Conversational Planning Interfaces
Yunhao Yang, Neel P. Bhatt, Christian Ellis +4
Logistics operators, from battlefield coordinators re-routing airlifts ahead of a storm to warehouse managers juggling late trucks, need to make mission-critical decisions. Prevail…