1 paper · 1 filter
Jungwon Park, Jungmin Ko, Dongnam Byun +2
Recent text-to-image diffusion models leverage cross-attention layers, which have been effectively utilized to enhance a range of visual generative tasks. However, our understandin…