activity
20242026
collaborators

5 papers

cs.CV2026

Variational Feature Compression for Model-Specific Representations

Zinan Guo, Zihan Wang, Chuan Yan +3

As deep learning inference is increasingly deployed in shared and cloud-based settings, a growing concern is input repurposing, in which data submitted for one task is reused by un…

cs.CV2026

Speed by Simplicity: A Single-Stream Architecture for Fast Audio-Video Generative Foundation Model

SII-GAIR, Sand. ai, : +43

We present daVinci-MagiHuman, an open-source audio-video generative foundation model for human-centric generation. daVinci-MagiHuman jointly generates synchronized video and audio…

cs.CV2025

DreamO: A Unified Framework for Image Customization

Chong Mou, Yanze Wu, Wenxu Wu +15

Recently, extensive research on image customization (e.g., identity, subject, style, background, etc.) demonstrates strong customization capabilities in large-scale generative mode…

cs.CV2025

MUSAR: Exploring Multi-Subject Customization from Single-Subject Dataset via Attention Routing

Zinan Guo, Pengze Zhang, Yanze Wu +3

Current multi-subject customization approaches encounter two critical challenges: the difficulty in acquiring diverse multi-subject training data, and attribute entanglement across…

cs.CV2024

PuLID: Pure and Lightning ID Customization via Contrastive Alignment

Zinan Guo, Yanze Wu, Zhuowei Chen +3

We propose Pure and Lightning ID customization (PuLID), a novel tuning-free ID customization method for text-to-image generation. By incorporating a Lightning T2I branch with a sta…