2 papers
cs.GR2025
VideoPanda: Video Panoramic Diffusion with Multi-view Attention
Kevin Xie, Amirmojtaba Sabour, Jiahui Huang +5
High resolution panoramic video content is paramount for immersive experiences in Virtual Reality, but is non-trivial to collect as it requires specialized equipment and intricate…
cs.LG2024
LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models
Zhengyi Wang, Jonathan Lorraine, Yikai Wang +4
This work explores expanding the capabilities of large language models (LLMs) pretrained on text to generate 3D meshes within a unified model. This offers key advantages of (1) lev…