papers

Publications (120)

cs.CV2023

SKU-Patch: Towards Efficient Instance Segmentation for Unseen Objects in Auto-Store

Biqi Yang, Weiliang Tang, Xiaojie Gao +4

cs.CV2020

PointAugment: an Auto-Augmentation Framework for Point Cloud Classification

Ruihui Li, Xianzhi Li, Pheng-Ann Heng +1

cs.CV2025

ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay

Fanbin Lu, Zhisheng Zhong, Shu Liu +2

cs.CV2025

MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation

Jinbo Xing, Long Mai, Cusuh Ham +5

cs.CV2023

You Only Need One Thing One Click: Self-Training for Weakly Supervised 3D Scene Understanding

Zhengzhe Liu, Xiaojuan Qi, Chi-Wing Fu

cs.CV2026

Unveiling Deep Shadows: A Survey and Benchmark on Image and Video Shadow Detection, Removal, and Generation in the Deep Learning Era

Xiaowei Hu, Zhenghao Xing, Tianyu Wang +2

cs.CV2019

Patch-based Output Space Adversarial Learning for Joint Optic Disc and Cup Segmentation

Shujun Wang, Lequan Yu, Xin Yang +2

cs.CV2022

Deep Parametric 3D Filters for Joint Video Denoising and Illumination Enhancement in Video Super Resolution

Xiaogang Xu, Ruixing Wang, Chi-Wing Fu +1

cs.CV2020

TilinGNN: Learning to Tile with Self-Supervised Graph Neural Network

Hao Xu, Ka Hei Hui, Chi-Wing Fu +1

cs.CV2026

EgoHandICL: Egocentric 3D Hand Reconstruction with In-Context Learning

Binzhu Xie, Shi Qiu, Sicheng Zhang +5

cs.CV2025

COS3D: Collaborative Open-Vocabulary 3D Segmentation

Runsong Zhu, Ka-Hei Hui, Zhengzhe Liu +5

cs.RO2025

GeoManip: Geometric Constraints as General Interfaces for Robot Manipulation

Weiliang Tang, Jia-Hui Pan, Yun-Hui Liu +4

cs.CV2023

DreamStone: Image as Stepping Stone for Text-Guided 3D Shape Generation

Zhengzhe Liu, Peng Dai, Ruihui Li +2

cs.GR2021

ActFloor-GAN: Activity-Guided Adversarial Networks for Human-Centric Floorplan Design

Shidong Wang, Wei Zeng, Xi Chen +3

cs.CG2025

Hand-Shadow Poser

Hao Xu, Yinqiao Wang, Niloy J. Mitra +3

cs.AI2025

MedHallTune: An Instruction-Tuning Benchmark for Mitigating Medical Hallucination in Vision-Language Models

Qiao Yan, Yuchen Yuan, Xiaowei Hu +6

cs.CV2021

Accurate Grid Keypoint Learning for Efficient Video Prediction

Xiaojie Gao, Yueming Jin, Qi Dou +2

cs.CV2025

HybridReg: Robust 3D Point Cloud Registration with Hybrid Motions

Keyu Du, Hao Xu, Haipeng Li +3

cs.CV2021

3D-to-2D Distillation for Indoor Scene Parsing

Zhengzhe Liu, Xiaojuan Qi, Chi-Wing Fu

cs.CV2022

Instance Shadow Detection with A Single-Stage Detector

Tianyu Wang, Xiaowei Hu, Pheng-Ann Heng +1

cs.CV2018

PU-Net: Point Cloud Upsampling Network

Lequan Yu, Xianzhi Li, Chi-Wing Fu +2

cs.CV2026

CHOIR: Contact-aware 4D Hand-Object Interaction Reconstruction

Hao Xu, Yilin Liu, Yinqiao Wang +2

cs.CV2024

CNS-Edit: 3D Shape Editing via Coupled Neural Shape Optimization

Jingyu Hu, Ka-Hei Hui, Zhengzhe Liu +2

cs.CV2018

Direction-aware Spatial Context Features for Shadow Detection

Xiaowei Hu, Lei Zhu, Chi-Wing Fu +2

cs.CV2018

H-DenseUNet: Hybrid Densely Connected UNet for Liver and Tumor Segmentation from CT Volumes

Xiaomeng Li, Hao Chen, Xiaojuan Qi +3

cs.CV2022

Neural Wavelet-domain Diffusion for 3D Shape Generation

Ka-Hei Hui, Ruihui Li, Jingyu Hu +1

cs.CV2022

Towards Implicit Text-Guided 3D Shape Generation

Zhengzhe Liu, Yi Wang, Xiaojuan Qi +1

cs.CV2024

SiMA-Hand: Boosting 3D Hand-Mesh Reconstruction by Single-to-Multi-View Adaptation

Yinqiao Wang, Hao Xu, Pheng-Ann Heng +1

cs.CV2023

SILT: Shadow-aware Iterative Label Tuning for Learning to Detect Shadows from Noisy Labels

Han Yang, Tianyu Wang, Xiaowei Hu +1

cs.CV2020

CIA-SSD: Confident IoU-Aware Single-Stage Object Detector From Point Cloud

Wu Zheng, Weiliang Tang, Sijin Chen +2

cs.GR2022

Learning Reconstructability for Drone Aerial Path Planning

Yilin Liu, Liqiang Lin, Yue Hu +4

cs.CV2019

Hierarchical Point-Edge Interaction Network for Point Cloud Semantic Segmentation

Li Jiang, Hengshuang Zhao, Shu Liu +3

cs.RO2025

Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning

Hao Chen, Jiaming Liu, Chenyang Gu +8

cs.CV2026

PEGAsus: 3D Personalization of Geometry and Appearance

Jingyu Hu, Bin Hu, Ka-Hei Hui +4

cs.CV2024

PointRegGPT: Boosting 3D Point Cloud Registration using Generative Point-Cloud Pairs for Training

Suyi Chen, Hao Xu, Haipeng Li +5

cs.CV2022

Semi-signed prioritized neural fitting for surface reconstruction from unoriented point clouds

Runsong Zhu, Di Kang, Ka-Hei Hui +6

cs.CV2021

Guided Point Contrastive Learning for Semi-supervised Point Cloud Semantic Segmentation

Li Jiang, Shaoshuai Shi, Zhuotao Tian +4

cs.CV2022

Boosting 3D Object Detection by Simulating Multimodality on Point Clouds

Wu Zheng, Mingxuan Hong, Li Jiang +1

cs.CV2024

MetaShadow: Object-Centered Shadow Detection, Removal, and Synthesis

Tianyu Wang, Jianming Zhang, Haitian Zheng +7

cs.CV2021

One Thing One Click: A Self-Training Approach for Weakly Supervised 3D Semantic Segmentation

Zhengzhe Liu, Xiaojuan Qi, Chi-Wing Fu

cs.CV2022

Boosting Single-Frame 3D Object Detection by Simulating Multi-Frame Point Clouds

Wu Zheng, Li Jiang, Fanbin Lu +2

cs.CV2024

PCF-Lift: Panoptic Lifting by Probabilistic Contrastive Fusion

Runsong Zhu, Shi Qiu, Qianyi Wu +3

cs.CV2026

Native Active Perception as Reasoning for Omni-Modal Understanding

Zhenghao Xing, Ruiyang Xu, Yuxuan Wang +8

cs.CV2020

DoFE: Domain-oriented Feature Embedding for Generalizable Fundus Image Segmentation on Unseen Datasets

Shujun Wang, Lequan Yu, Kang Li +3

cs.RO2025

Rethinking Intermediate Representation for VLM-based Robot Manipulation

Weiliang Tang, Jialin Gao, Jia-Hui Pan +6

cs.CV2018

EC-Net: an Edge-aware Point set Consolidation Network

Lequan Yu, Xianzhi Li, Chi-Wing Fu +2

cs.CV2019

Boundary and Entropy-driven Adversarial Learning for Fundus Image Segmentation

Shujun Wang, Lequan Yu, Kang Li +3

cs.CL2025

Silence is Not Consensus: Disrupting Agreement Bias in Multi-Agent LLMs via Catfish Agent for Clinical Decision Making

Yihan Wang, Qiao Yan, Zhenghao Xing +5

cs.GR2020

DNF-Net: a Deep Normal Filtering Network for Mesh Denoising

Xianzhi Li, Ruihui Li, Lei Zhu +2

cs.CV2020

Instance Shadow Detection

Tianyu Wang, Xiaowei Hu, Qiong Wang +2

cs.CV2024

Towards Real-World Adverse Weather Image Restoration: Enhancing Clearness and Semantics with Vision-Language Models

Jiaqi Xu, Mengyang Wu, Xiaowei Hu +3

cs.RO2025

DisCo-Layout: Disentangling and Coordinating Semantic and Physical Refinement in a Multi-Agent Framework for 3D Indoor Layout Synthesis

Jialin Gao, Donghao Zhou, Mingjian Liang +4

cs.HC2024

LassoNet: Deep Lasso-Selection of 3D Point Clouds

Chen Zhu-Tian, Wei Zeng, Zhiguang Yang +3

cs.CV2021

FloorLevel-Net: Recognizing Floor-Level Lines with Height-Attention-Guided Multi-task Learning

Mengyang Wu, Wei Zeng, Chi-Wing Fu

cs.GR2020

GrabAR: Occlusion-aware Grabbing Virtual Objects in AR

Xiao Tang, Xiaowei Hu, Chi-Wing Fu +1

cs.CV2021

A Rotation-Invariant Framework for Deep Point Cloud Analysis

Xianzhi Li, Ruihui Li, Guangyong Chen +3

eess.IV2020

Mononizing Binocular Videos

Wenbo Hu, Menghan Xia, Chi-Wing Fu +1

cs.CV2019

Uncertainty-aware Self-ensembling Model for Semi-supervised 3D Left Atrium Segmentation

Lequan Yu, Shujun Wang, Xiaomeng Li +2

eess.IV2019

CANet: Cross-disease Attention Network for Joint Diabetic Retinopathy and Diabetic Macular Edema Grading

Xiaomeng Li, Xiaowei Hu, Lequan Yu +3

cs.CV2024

Object-level Scene Deocclusion

Zhengzhe Liu, Qing Liu, Chirui Chang +6

cs.CV2021

SP-GAN: Sphere-Guided 3D Shape Generation and Manipulation

Ruihui Li, Xianzhi Li, Ka-Hei Hui +1

cs.CV2022

On Learning the Right Attention Point for Feature Enhancement

Liqiang Lin, Pengdi Huang, Chi-Wing Fu +3

cs.GR2020

Unsupervised Detection of Distinctive Regions on 3D Shapes

Xianzhi Li, Lequan Yu, Chi-Wing Fu +2

cs.CV2026

OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation

Donghao Zhou, Guisheng Liu, Hao Yang +9

cs.CV2021

SE-SSD: Self-Ensembling Single-Stage Object Detector From Point Cloud

Wu Zheng, Weiliang Tang, Li Jiang +1

cs.CV2020

Revisiting Metric Learning for Few-Shot Image Classification

Xiaomeng Li, Lequan Yu, Chi-Wing Fu +2

cs.HC2026

A Collaborative Extended Reality Prototype for 3D Surgical Planning and Visualization

Shi Qiu, Ruiyang Li, Qixuan Liu +6

cs.CV2020

Transformation Consistent Self-ensembling Model for Semi-supervised Medical Image Segmentation

Xiaomeng Li, Lequan Yu, Hao Chen +3

cs.CV2019

Mask-ShadowGAN: Learning to Remove Shadows from Unpaired Data

Xiaowei Hu, Yitong Jiang, Chi-Wing Fu +1

cs.CV2023

Neural Wavelet-domain Diffusion for 3D Shape Generation, Inversion, and Manipulation

Jingyu Hu, Ka-Hei Hui, Zhengzhe Liu +2

cs.CV2023

EXIM: A Hybrid Explicit-Implicit Representation for Text-Guided 3D Shape Generation

Zhengzhe Liu, Jingyu Hu, Ka-Hei Hui +3

cs.CV2020

SAC-Net: Spatial Attenuation Context for Salient Object Detection

Xiaowei Hu, Chi-Wing Fu, Lei Zhu +2

cs.CV2026

CNS-Edit++: Category-Agnostic 3D Editing with Coupled Neural Shape Representation

Jingyu Hu, Weilong Yan, Zhengzhe Liu +6

cs.CV2019

PU-GAN: a Point Cloud Upsampling Adversarial Network

Ruihui Li, Xianzhi Li, Chi-Wing Fu +2

cs.CV2021

Point Cloud Upsampling via Disentangled Refinement

Ruihui Li, Xianzhi Li, Pheng-Ann Heng +1

cs.CV2019

Deep Floor Plan Recognition Using a Multi-Task Network with Room-Boundary-Guided Attention

Zhiliang Zeng, Xianzhi Li, Ying Kin Yu +1

cs.HC2025

CvhSlicer 2.0: Immersive and Interactive Visualization of Chinese Visible Human Data in XR Environments

Yue Qiu, Yuqi Tong, Yu Zhang +5

cs.CV2025

Rethinking End-to-End 2D to 3D Scene Segmentation in Gaussian Splatting

Runsong Zhu, Shi Qiu, Zhengzhe Liu +4

cs.CV2025

Not-So-Optimal Transport Flows for 3D Point Cloud Generation

Ka-Hei Hui, Chao Liu, Xiaohui Zeng +2

cs.CV2019

Multi-Task Recurrent Convolutional Network with Correlation Loss for Surgical Video Analysis

Yueming Jin, Huaxia Li, Qi Dou +4

cs.GR2023

UrbanBIS: a Large-scale Benchmark for Fine-grained Urban Building Instance Segmentation

Guoqing Yang, Fuyou Xue, Qi Zhang +3

cs.HC2025

Coordinated 2D-3D Visualization of Volumetric Medical Data in XR with Multimodal Interactions

Qixuan Liu, Shi Qiu, Yinqiao Wang +4

cs.CV2025

UniHOPE: A Unified Approach for Hand-Only and Hand-Object Pose Estimation

Yinqiao Wang, Hao Xu, Pheng-Ann Heng +1

cs.CV2025

Overcoming Support Dilution for Robust Few-shot Semantic Segmentation

Wailing Tang, Biqi Yang, Pheng-Ann Heng +2

physics.flu-dyn2017

Towards High-quality Visualization of Superfluid Vortices

Yulong Guo, Xiaopei Liu, Chi Xiong +2

cs.CV2025

IdentityStory: Taming Your Identity-Preserving Generator for Human-Centric Story Generation

Donghao Zhou, Jingyu Lin, Guibao Shen +8

cs.AI2025

Incentivizing Multimodal Reasoning in Large Models for Direct Robot Manipulation

Weiliang Tang, Dong Jing, Jia-Hui Pan +5

cs.CV2024

Make-A-Shape: a Ten-Million-scale 3D Shape Model

Ka-Hei Hui, Aditya Sanghi, Arianna Rampini +4

cs.CV2025

OpenView: Empowering MLLMs with Out-of-view VQA

Qixiang Chen, Cheng Zhang, Chi-Wing Fu +2

cs.CV2022

Neural Template: Topology-aware Reconstruction and Disentangled Generation of 3D Meshes

Ka-Hei Hui, Ruihui Li, Jingyu Hu +1

cs.CV2025

ICM-Assistant: Instruction-tuning Multimodal Large Language Models for Rule-based Explainable Image Content Moderation

Mengyang Wu, Yuzhi Zhao, Jialun Cao +7

cs.CV2022

The Liver Tumor Segmentation Benchmark (LiTS)

Patrick Bilic, Patrick Christ, Hongwei Bran Li +106

cs.CV2018

Semi-supervised Skin Lesion Segmentation via Transformation Consistent Self-ensembling Model

Xiaomeng Li, Lequan Yu, Hao Chen +2

cs.CV2024

Video Instance Shadow Detection Under the Sun and Sky

Zhenghao Xing, Tianyu Wang, Xiaowei Hu +3

cs.CV2021

Revisiting Shadow Detection: A New Benchmark Dataset for Complex World

Xiaowei Hu, Tianyu Wang, Chi-Wing Fu +3

cs.CV2020

PointGroup: Dual-Set Point Grouping for 3D Instance Segmentation

Li Jiang, Hengshuang Zhao, Shaoshuai Shi +3

cs.CV2025

STEVE: A Step Verification Pipeline for Computer-use Agent Training

Fanbin Lu, Zhisheng Zhong, Ziqin Wei +3

cs.RO2024

Embodiment-Agnostic Action Planning via Object-Part Scene Flow

Weiliang Tang, Jia-Hui Pan, Wei Zhan +6

cs.CV2023

ISS: Image as Stepping Stone for Text-Guided 3D Shape Generation

Zhengzhe Liu, Peng Dai, Ruihui Li +2

cs.CV2020

Learning from Extrinsic and Intrinsic Supervisions for Domain Generalization

Shujun Wang, Lequan Yu, Caizi Li +2