Showing cs.AIShow all
2 papers · 1 filter
cs.AI2025
VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences
Anukriti Singh, Amisha Bhaskar, Peihong Yu +4
Designing reward functions for continuous-control robotics often leads to subtle misalignments or reward hacking, especially in complex tasks. Preference-based RL mitigates some of…
cs.AI2024
PLANRL: A Motion Planning and Imitation Learning Framework to Bootstrap Reinforcement Learning
Amisha Bhaskar, Zahiruddin Mahammad, Sachin R Jadhav +1
Reinforcement Learning (RL) has shown remarkable progress in simulation environments, yet its application to real-world robotic tasks remains limited due to challenges in explorati…