1 paper · 1 filter
Jun Wen Leong
Reasoning models deployed as safety monitors exhibit a systematic vulnerability: reasoning-token budget starvation. Adversarial inputs require 3.3× more reasoning tokens tha…