2 papers
cs.LG2026
Unification and Optimization of Robust Supervised Learning
Jonas Hanselle, Valentin Margraf, Clemens Damke +1
The literature has proposed various robust alternatives to empirical risk minimisation to address failure modes such as distribution shift, label noise and finite-sample degeneraci…
cs.LG2025
Co-Exploration and Co-Exploitation via Shared Structure in Multi-Task Bandits
Sumantrak Mukherjee, Serafima Lebedeva, Valentin Margraf +6
We propose a novel Bayesian framework for efficient exploration in contextual multi-task multi-armed bandit settings, where the context is only observed partially and dependencies…