Showing 2026Show all
2 papers · 1 filter
cs.LG2026
Latent Q-Barrier Shielding for Safe In-Context Reinforcement Learning
Minjae Kwon, Amir Moeini, Shangtong Zhang +1
Safe in-context reinforcement learning (ICRL) adapts online from interaction history without test-time parameter updates while controlling episode cost under a safety budget. Under…
cs.LG2026
Safety Generalization Under Distribution Shift in Safe Reinforcement Learning: A Diabetes Testbed
Minjae Kwon, Josephine Lamp, Lu Feng
Safe Reinforcement Learning (RL) algorithms are typically evaluated under fixed training conditions. We investigate whether training-time safety guarantees transfer to deployment u…