4 citations · 21 across the 41 of their papers we have counts for
4 papers · 1 filter
MMCD: Multi-Modal Collaborative Decision-Making for Connected Autonomy with Knowledge Distillation
Rui Liu, Zikang Wang, Peng Gao +3
Autonomous systems have advanced significantly, but challenges persist in accident-prone environments where robust decision-making is crucial. A single vehicle's limited sensor ran…
Multi-Agent Trust Region Policy Optimisation: A Joint Constraint Approach
Chak Lam Shek, Guangyao Shi, Pratap Tokekar
Multi-agent reinforcement learning (MARL) requires coordinated and stable policy updates among interacting agents. Heterogeneous-Agent Trust Region Policy Optimization (HATRPO) enf…
VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences
Anukriti Singh, Amisha Bhaskar, Peihong Yu +4
Designing reward functions for continuous-control robotics often leads to subtle misalignments or reward hacking, especially in complex tasks. Preference-based RL mitigates some of…
An Approximation Algorithm for Risk-averse Submodular Optimization
Lifeng Zhou, Pratap Tokekar
We study the problem of incorporating risk while making combinatorial decisions under uncertainty. We formulate a discrete submodular maximization problem for selecting a set using…