1 paper · 1 filter
Zhou Jiang, Yandong Wen, Zhen Liu
Aligning large-scale text-to-image diffusion models with nuanced human preferences remains challenging. While direct preference optimization (DPO) is simple and effective, large-sc…