Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
3SPO: State-Score-Supervised Policy Optimization for LLM Agents
Yu Han, Kailing Li, Yang Jiao +4
Training large language models (LLMs) as autonomous agents via reinforcement learning (RL) has enabled frontier models to achieve superhuman performance in long-horizon tasks. Howe…
cs.LG2023
BadRL: Sparse Targeted Backdoor Attack Against Reinforcement Learning
Jing Cui, Yufei Han, Yuzhe Ma +2
Backdoor attacks in reinforcement learning (RL) have previously employed intense attack strategies to ensure attack success. However, these methods suffer from high attack costs an…