3 papers
cs.LG2026
TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models
Yang Dai, Oubo Ma, Longfei Zhang +6
Recent advances in Trajectory Optimization (TO) models have achieved remarkable success in offline reinforcement learning. However, their vulnerabilities against backdoor attacks a…
cs.LG2026
Flow-based Policy With Distributional Reinforcement Learning in Trajectory Optimization
Ruijie Hao, Longfei Zhang, Yang Dai +3
Reinforcement Learning (RL) has proven highly effective in addressing complex control and decision-making tasks. However, in most traditional RL algorithms, the policy is typically…
cs.LG2024
Is Mamba Compatible with Trajectory Optimization in Offline Reinforcement Learning?
Yang Dai, Oubo Ma, Longfei Zhang +6
Transformer-based trajectory optimization methods have demonstrated exceptional performance in offline Reinforcement Learning (offline RL). Yet, it poses challenges due to substant…