1 paper · 1 filter
Zhinan Liu, Jie Li, Mingyu Kang +1
Reasoning-based guard models improve LLM safeguards, but decoding explicit rationales for every interaction makes them costly to deploy. Although latent-reasoning methods reduce to…