1 paper
Xuanhua Yin, Chuanzhi Xu, Haoxian Zhou +2
Diffusion Transformers (DiTs) are a dominant backbone for high-fidelity text-to-image generation due to strong scalability and alignment at high resolutions. However, quadratic sel…