3 papers
cs.CV2026
Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning
Yuqi Zhang, Yadan Luo, Xiangyu Sun +3
High-quality 3D scene assets are critical for embodied applications such as robotic manipulation, navigation, and simulation. Despite their strong object priors, recent single-imag…
cs.CV2026
TALO: Pushing 3D Vision Foundation Models Towards Globally Consistent Online Reconstruction
Fengyi Zhang, Tianjun Zhang, Kasra Khosoussi +3
3D vision foundation models have shown strong generalization in reconstructing key 3D attributes from uncalibrated images through a single feed-forward pass. However, when deployed…
cs.CV2026
Test-Time 3D Occupancy Prediction
Fengyi Zhang, Xiangyu Sun, Huitong Yang +3
Self-supervised 3D occupancy prediction offers a promising solution for understanding complex driving scenes without requiring costly 3D annotations. However, training dense occupa…