1 paper
Yujin Jeong, Arnas Uselis, Iro Laina +2
Text-to-image diffusion models achieve impressive visual fidelity, yet they remain unreliable in multi-object generation. Despite extensive empirical evidence of these failures, th…