2 papers
cs.AI2026
Sketch Then Paint: Hierarchical Reinforcement Learning for Diffusion Multi-Modal Large Language Models
Siqi Luo, Jianghan Shen, Yi Xin +9
Diffusion Multi-Modal Large Language Models (dMLLMs) are powerful for image generation, but optimizing them through reinforcement learning (RL) remains a major challenge. One prima…
cs.CV2026
A-Edit: Precise Reference-Guided Image Editing of Arbitrary Objects and Ambiguous Masks
Huayu Zheng, Guangzhao Li, Baixuan Zhao +4
We propose A^2-Edit, a unified inpainting framework for arbitrary object categories, which allows users to replace any target region with a reference object using only a coarse mas…