3 papers
cs.LG2026
General Uncertainty Estimation with Delta Variances
Simon Schmitt, John Shawe-Taylor, Hado van Hasselt
Decision makers may suffer from uncertainty induced by limited data. This may be mitigated by accounting for epistemic uncertainty, which is however challenging to estimate efficie…
cs.LG2025
Scalable Meta-Learning via Mixed-Mode Differentiation
Iurii Kemaev, Dan A Calian, Luisa M Zintgraf +2
Gradient-based bilevel optimisation is a powerful technique with applications in hyperparameter optimisation, task adaptation, algorithm discovery, meta-learning more broadly, and…
cs.LG2025
Wasserstein Policy Optimization
David Pfau, Ian Davies, Diana Borsa +3
We introduce Wasserstein Policy Optimization (WPO), an actor-critic algorithm for reinforcement learning in continuous action spaces. WPO can be derived as an approximation to Wass…