collaborators

19 papers

cs.CV2026

Correlation-Aware and Gaussianity-Preserving Robust Latent Angular Watermarking for Diffusion Models

Yebin Zheng, Haonan An, Guang Hua +2

Latent domain watermarking for diffusion models embeds watermarks directly into the latent prior, enjoying non-intrusiveness to model parameters and seamless integration with the g…

cs.CV2026

Universal Image Restoration via Internalized Chain-of-Thought Reasoning

Yu Guo, Zhengru Fang, Shengfeng He +4

Image restoration seeks to recover high-quality images from degraded inputs but becomes highly ill-posed under complex, mixed degradations. While unified all-in-one models are comm…

cs.RO2026

Multi-Agent Embodied Autonomous Driving (MAEAD): From V2X Information Exchange to Shared World Models

Senkang Hu, Zhengru Fang, Yihang Tao +4

Autonomous driving is shifting from isolated vehicle intelligence toward multi-agent embodied systems that share perception, infer intent, and coordinate action under uncertainty.…

cs.CV2026

FRUC: Feedforward Dynamic Scene Reconstruction from Uncalibrated Collaborative Driving Views

Yihang Tao, Yu Guo, Zhengru Fang +2

We present FRUC, a feed-forward 3D Gaussian splatting framework for dynamic scene reconstruction from uncalibrated collaborative driving views. Existing multi-agent reconstruction…

cs.RO2026

Agent-Centric Observation Adaptation for Robust Visual Control under Dynamic Perturbations

Zhengru Fang, Yu Guo, Fei Liu +5

Real-world visual systems face time-varying perturbations, including weather, sensor noise, compression artifacts, and background distractions. Existing image restoration methods a…

cs.CV2026

CXR-ContraBench: Benchmarking Negated-Option Attraction in Medical VLMs

Zhengru Fang, Yanan Ma, Yu Guo +5

When a chest X-ray shows consolidation but the question asks which finding is present, a medical vision-language model may answer "No consolidation." This is more than an incorrect…