2 papers
cs.CV2026
Long-Tail Adaptive Flow Matching with Explicit Conditional Consistency Guidance for Precise Multimodal Face Synthesis
Yushe Cao, Xuechao Zou, Xing Xi +3
Although diffusion-based methods have substantially improved the controllability of multimodal face synthesis, their semantic alignment remains suboptimal because most existing app…
cs.CV2026
LiveVVT: High-Fidelity Video Virtual Try-On in Real Time
Yushe Cao, Shikun Feng, Ruxiang Duan +4
Diffusion-based Video Virtual Try-On (VVT) achieves high visual fidelity through bidirectional spatio-temporal modeling, but complete-clip dependence incurs prohibitive latency and…