3 papers
cs.LG2026
Generative OOD-regularized Model-based Policy Optimization
Aysin Tumay, Jiahe Huang, Elise Jortberg +1
We study sequential decision-making with offline reinforcement learning (RL). Traditional offline RL policies may result in out-of-distribution (OOD) actions when training relies o…
cs.LG2026
Manifold-Guided Attention Steering
Ian Li, Kapilesh Guruprasad, Raunak Sengupta +3
Large language models frequently produce errors in reasoning tasks despite possessing the underlying knowledge required for correct reasoning. One possible approach to improve reas…
cs.LG2026
Rethinking Diffusion Models with Symmetries through Canonicalization with Applications to Molecular Graph Generation
Cai Zhou, Zijie Chen, Zian Li +7
Many generative tasks in chemistry and science involve distributions invariant to group symmetries (e.g., permutation and rotation). A common strategy enforces invariance and equiv…