Publications (18)
Efficient Exploration in Continuous-time Model-based Reinforcement Learning
Lenart Treven, Jonas Hübotter, Bhavya Sukhija +2
Simulation Priors for Data-Efficient Deep Learning
Lenart Treven, Bhavya Sukhija, Jonas Rothfuss +3
Learning Stabilizing Controllers for Unstable Linear Quadratic Regulators from a Single Trajectory
Lenart Treven, Sebastian Curi, Mojmir Mutny +1
When to Sense and Control? A Time-adaptive Approach for Continuous-Time RL
Lenart Treven, Bhavya Sukhija, Yarden As +2
Iterative Correction of Sensor Degradation and a Bayesian Multi-Sensor Data Fusion Method
Luka Kolar, Rok Å ikonja, Lenart Treven
ActSafe: Active Exploration with Safety Constraints for Reinforcement Learning
Yarden As, Bhavya Sukhija, Lenart Treven +3
Active Few-Shot Fine-Tuning
Jonas Hübotter, Bhavya Sukhija, Lenart Treven +2
TARC: Time-Adaptive Robotic Control
Arnav Sukhija, Lenart Treven, Jin Cheng +3
Gemma 4 Technical Report
Gemma Team, Sherif El Abd, Vaibhav Aggarwal +320
NeoRL: Efficient Exploration for Nonepisodic RL
Bhavya Sukhija, Lenart Treven, Florian Dörfler +2
Bridging the Sim-to-Real Gap with Bayesian Inference
Jonas Rothfuss, Bhavya Sukhija, Lenart Treven +3
Optimistic Active Exploration of Dynamical Systems
Bhavya Sukhija, Lenart Treven, Cansu Sancaktar +3
Transductive Active Learning: Theory and Applications
Jonas Hübotter, Bhavya Sukhija, Lenart Treven +2
SOMBRL: Scalable and Optimistic Model-Based RL
Bhavya Sukhija, Lenart Treven, Carmelo Sferrazza +3
Model-Based Reinforcement Learning for Control under Time-Varying Dynamics
Klemens Iten, Bruce Lee, Chenhao Li +3
Optimistic Online LQR via Intrinsic Rewards
Marcell Bartos, Bruce D. Lee, Lenart Treven +3
Sample-efficient and Scalable Exploration in Continuous-Time RL
Klemens Iten, Lenart Treven, Bhavya Sukhija +2
Distributional Gradient Matching for Learning Uncertain Neural Dynamics Models
Lenart Treven, Philippe Wenk, Florian Dörfler +1