1 paper · 1 filter
Renye Yan, Jikang Cheng, You Wu +9
Latent diffusion models (LDMs) enable efficient high-resolution image synthesis by denoising in a VAE-compressed latent space. However, fixed visual tokenizers can discard fine tex…