1 paper · 1 filter
Jiachen Qian, Junyu Li
Audio-capable foundation models enable end-to-end spoken interaction, but they also introduce safety risks beyond transcript content. It remains unclear how much jailbreak capabili…