Showing cs.LGShow all
2 papers · 1 filter
cs.LG2025
Disentangling Exploration of Large Language Models by Optimal Exploitation
Tim Grams, Patrick Betz, Sascha Marton +2
Exploration is a crucial skill for in-context reinforcement learning in unknown environments. However, it remains unclear if large language models can effectively explore a partial…
cs.LG2025
Mitigating Information Loss in Tree-Based Reinforcement Learning via Direct Optimization
Sascha Marton, Tim Grams, Florian Vogt +3
Reinforcement learning (RL) has seen significant success across various domains, but its adoption is often limited by the black-box nature of neural network policies, making them d…