2 papers
cs.CV2026
End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer
Wenda Chu, Bingliang Zhang, Jiaqi Han +4
Autoregressive image modeling relies on visual tokenizers to compress images into compact latent representations. We design an end-to-end training pipeline that jointly optimizes r…
cs.CV2025
Dual Diffusion for Unified Image Generation and Understanding
Zijie Li, Henry Li, Yichun Shi +4
Diffusion models have gained tremendous success in text-to-image generation, yet still lag behind with visual understanding tasks, an area dominated by autoregressive vision-langua…