collaborators

7 papers

cs.CV2026

IDEAL-Bench: Indoor Dataset and Evaluation suite for Analyzing 3D Layout reasoning

Yuening Cai, Junwei Zhou, Youran Qu +1

Spatial question answering is the dominant paradigm for evaluating spatial intelligence in Vision-Language Models (VLMs), but it leaves a complementary axis of spatial competence u…

cs.CV2026

GENA3D: Generative Amodal 3D Modeling by Bridging 2D Priors and 3D Coherence

Junwei Zhou, Yu-Wing Tai

Generating complete 3D objects under partial occlusions (i.e., amodal scenarios) is a practically important yet challenging problem, as large portions of object geometry are unobse…

cs.CV2026

Perceive-then-Plan: Layout-as-Policy for Monocular 3D Scene Layout Estimation

Junwei Zhou, Yu-Wing Tai

Building structured 3D scene layouts from a single image requires reconciling visual observations with physical and spatial constraints, a challenge that is difficult to address wi…

cs.CV2026

Distributed Image Compression with Multimodal Side Information at Extremely Low Bitrates

Guojun Xu, Mingyang Zhang, Jianwen Xiang +3

Distributed Image Compression (DIC) is crucial for multi-view transmission, especially when operating at extremely low bitrates (< 0.1 bpp). Its core challenge is effectively utili…

cs.RO2025

VF-Plan: Bridging the Art Gallery Problem and Static LiDAR Scanning with Visibility Field Optimization

Biao Xiong, Longjun Zhang, Ruiqi Huang +4

Viewpoint planning is critical for efficient 3D data acquisition in applications such as 3D reconstruction, building life-cycle management, navigation, and interior decoration. How…

cs.CV2025

CoCo4D: Comprehensive and Complex 4D Scene Generation

Junwei Zhou, Xueting Li, Lu Qi +1

Existing 4D synthesis methods primarily focus on object-level generation or dynamic scene synthesis with limited novel views, restricting their ability to generate multi-view consi…