1 paper
Haotian Xu, Zeyang Zhang, Linbao Li +3
Speculative inference accelerates large language model (LLM) decoding but provides no inherent safety guarantees. Existing safety defenses are largely incompatible with speculative…