1 paper
Kaiyan Wen, Shijie Zhang, Lu Yu +1
Text-to-image (T2I) models remain vulnerable to jailbreak attacks that elicit Not-Safe-For-Work (NSFW) content, despite increasingly being guarded by heterogeneous, multi-layer saf…