2 papers
cs.CV2026
Rethinking Point Clouds as Sequences: A Causal Next-Token Predictive Learning Framework
Yumeng Yao, Jingzhi Dong, Haowen Gu +4
With the rapid progress of multimodal foundation models and predictive pre-training, an important open question is how to equip 3D point clouds with a pre-training paradigm that is…
cs.CV2024
COMOGen: A Controllable Text-to-3D Multi-object Generation Framework
Shaorong Sun, Shuchao Pang, Yazhou Yao +1
The controllability of 3D object generation methods is achieved through input text. Existing text-to-3D object generation methods primarily focus on generating a single object base…