2 papers
cs.LG2026
In-Context Compositional Q-Learning for Offline Reinforcement Learning
Qiushui Xu, Yuhao Huang, Yushu Jiang +4
Accurate estimation of the Q-function is a central challenge in offline reinforcement learning. However, existing approaches often rely on a shared global Q-function, which is inad…
cs.LG2025
Unveiling Markov Heads in Pretrained Language Models for Offline Reinforcement Learning
Wenhao Zhao, Qiushui Xu, Linjie Xu +4
Recently, incorporating knowledge from pretrained language models (PLMs) into decision transformers (DTs) has generated significant attention in offline reinforcement learning (RL)…