Showing cs.LGShow all
2 papers · 1 filter
cs.LG2025
Variational Online Mirror Descent for Robust Learning in Schrödinger Bridge
Dong-Sig Han, Jaein Kim, Hee Bin Yoo +1
The Schrödinger bridge (SB) has evolved into a universal class of probabilistic generative models. In practice, however, estimated learning signals are innately uncertain, and the…
cs.LG2024
Unveiling the Significance of Toddler-Inspired Reward Transition in Goal-Oriented Reinforcement Learning
Junseok Park, Yoonsung Kim, Hee Bin Yoo +5
Toddlers evolve from free exploration with sparse feedback to exploiting prior experiences for goal-directed learning with denser rewards. Drawing inspiration from this Toddler-Ins…