4 papers · 1 filter
EAM: Enhancing Anything with Diffusion Transformers for Blind Super-Resolution
Haizhen Xie, Kunpeng Du, Qiangyu Yan +5
Utilizing pre-trained Text-to-Image (T2I) diffusion models to guide Blind Super-Resolution (BSR) has become a predominant approach in the field. While T2I models have traditionally…
DSPO: Direct Semantic Preference Optimization for Real-World Image Super-Resolution
Miaomiao Cai, Simiao Li, Wei Li +4
Recent advances in diffusion models have improved Real-World Image Super-Resolution (Real-ISR), but existing methods lack human feedback integration, risking misalignment with huma…
Autoregressive Image Generation with Vision Full-view Prompt
Miaomiao Cai, Guanjie Wang, Wei Li +4
In autoregressive (AR) image generation, models based on the 'next-token prediction' paradigm of LLMs have shown comparable performance to diffusion models by reducing inductive bi…
GIM: A Million-scale Benchmark for Generative Image Manipulation Detection and Localization
Yirui Chen, Xudong Huang, Quan Zhang +9
The extraordinary ability of generative models emerges as a new trend in image editing and generating realistic images, posing a serious threat to the trustworthiness of multimedia…