2 papers
cs.CV2026
Dual Inversion for Text-to-Image Diffusion Models: From Both Prompt and Noise Perspectives
Xiaolong Liu, Junjian Li, Yuan Xiao +4
Prompt inversion, as a typical reverse engineering technique, enables text-to-image (T2I) diffusion models to generate the desired target images without extensive prompt engineerin…
cs.CV2026
ThinkBLOX: 3D Indoor Scene Generation with Progressive Reasoning
Yuan Xiao, Can Wang, Xiangyu Kong +1
While traditional graphics methods often synthesize 3D indoor scenes autoregressively or hierarchically, recent vision-language model (VLM)-based generators predominantly adopt a o…