1 paper · 1 filter
Yoann Poupart, Aurélie Beynier, Nicolas Maudet
The paper introduces Policy Gradient Steering (PGS), a reinforcement‑learning based method that uses temporary behavioral objectives to compute removable task vectors for steering…