Showing cs.ROShow all
3 papers · 1 filter
cs.RO2026
Beyond Imitation: Self-Improving Robot Policies via Off-Policy Q-Planning
Varun Giridhar, Anant Khandelwal, Jeremy A. Collins +2
Behaviour Cloning (BC) has driven remarkable progress in robot manipulation, yet it is fundamentally limited by its inability to self-improve: a policy that fails cannot learn from…
cs.RO2025
Learning Deployable Locomotion Control via Differentiable Simulation
Clemens Schwarke, Victor Klemm, Joshua Bagajo +4
Differentiable simulators promise to improve sample efficiency in robot learning by providing analytic gradients of the system dynamics. Yet, their application to contact-rich task…
cs.RO2024
DiffSim2Real: Deploying Quadrupedal Locomotion Policies Purely Trained in Differentiable Simulation
Joshua Bagajo, Clemens Schwarke, Victor Klemm +5
Differentiable simulators provide analytic gradients, enabling more sample-efficient learning algorithms and paving the way for data intensive learning tasks such as learning from…