3 papers
cs.CV2026
Hierarchical Prompt Injector for Domain Generalization Segmentation
Xin Kun Lin, Ruoyu Guo, Jiaqi Guo +2
Domain Generalized Semantic Segmentation (DGSS) is a challenging task, as vision models often rely on low-level appearance cues that change across domains. In contrast, structural…
cs.CV2026
P-PatchDiff: Progressive Patch Diffusion Models for Low-light Image Enhancement
Ruoyu Guo, Haonan Zhong, Maurice Pagnucco +1
Recent advancements in low-light image enhancement have leveraged diffusion models for their strong ability to generate perceptually realistic, detailed images. Patch diffusion mod…
cs.CV2026
Bernini: Latent Semantic Planning for Video Diffusion
Bernini Team, Chenchen Liu, Junyi Chen +9
Multimodal large language models (MLLMs) and diffusion models have each reached remarkable maturity: MLLMs excel at reasoning over heterogeneous multimodal inputs with strong seman…