2 papers
cs.CV2026
RefAny3D: 3D Asset-Referenced Diffusion Models for Image Generation
Hanzhuo Huang, Qingyang Bao, Zekai Gu +4
In this paper, we propose a 3D asset-referenced diffusion model for image generation, exploring how to integrate 3D assets into image diffusion models. Existing reference-based ima…
cs.CV2025
MVTokenFlow: High-quality 4D Content Generation using Multiview Token Flow
Hanzhuo Huang, Yuan Liu, Ge Zheng +3
In this paper, we present MVTokenFlow for high-quality 4D content creation from monocular videos. Recent advancements in generative models such as video diffusion models and multiv…