Showing 2024Show all
2 papers · 1 filter
cs.CV2024
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
Xiaotao Hu, Wei Yin, Mingkai Jia +6
Recent successes in autoregressive (AR) generation models, such as the GPT series in natural language processing, have motivated efforts to replicate this success in visual tasks.…
cs.CV2024
Era3D: High-Resolution Multiview Diffusion using Efficient Row-wise Attention
Peng Li, Yuan Liu, Xiaoxiao Long +10
In this paper, we introduce Era3D, a novel multiview diffusion method that generates high-resolution multiview images from a single-view image. Despite significant advancements in…