Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
GPO-V: Jailbreak Diffusion Vision Language Model by Global Probability Optimization
Yu Pan, Andi Zhang, Yi Wang +2
Diffusion Vision-Language Models (dVLMs), built upon the non-causal foundations of Diffusion Large Language Models (dLLMs), have demonstrated remarkable efficacy in multimodal task…
cs.CV2025
VTON 360: High-Fidelity Virtual Try-On from Any Viewing Direction
Zijian He, Yuwei Ning, Yipeng Qin +4
Virtual Try-On (VTON) is a transformative technology in e-commerce and fashion design, enabling realistic digital visualization of clothing on individuals. In this work, we propose…