2 papers
cs.CV2025
Point Cloud Self-supervised Learning via 3D to Multi-view Masked Learner
Zhimin Chen, Xuewei Chen, Xiao Guo +4
Recently, multi-modal masked autoencoders (MAE) has been introduced in 3D self-supervised learning, offering enhanced feature learning by leveraging both 2D and 3D data to capture…
cs.CV2025
TransAnimate: Taming Layer Diffusion to Generate RGBA Video
Xuewei Chen, Zhimin Chen, Yiren Song
Text-to-video generative models have made remarkable advancements in recent years. However, generating RGBA videos with alpha channels for transparency and visual effects remains a…