From the 1 of 26 linked papers with an AI index.
1 paper · 1 filter
Seil Kang, Woojung Han, Dayun Ju +1
Starting from flow- and diffusion-based transformers, Multi-modal Diffusion Transformers (MM-DiTs) have reshaped text-to-vision generation, gaining acclaim for exceptional visual f…