1 paper · 1 filter
Zhenxing Mi, Kuan-Chieh Wang, Guocheng Qian +5
This paper presents ThinkDiff, a novel alignment paradigm that empowers text-to-image diffusion models with multimodal in-context understanding and reasoning capabilities by integr…