2 papers
cs.AI2026
Preference-Agile Multi-Objective Optimization for Real-time Vehicle Dispatching
Jiahuan Jin, Wenhao Zhao, Rong Qu +4
Multi-objective optimization (MOO) has been widely studied in literature because of its versatility in human-centered decision making in real-life applications. Recently, demand fo…
cs.LG2025
Unveiling Markov Heads in Pretrained Language Models for Offline Reinforcement Learning
Wenhao Zhao, Qiushui Xu, Linjie Xu +4
Recently, incorporating knowledge from pretrained language models (PLMs) into decision transformers (DTs) has generated significant attention in offline reinforcement learning (RL)…