Publications (120)
SKU-Patch: Towards Efficient Instance Segmentation for Unseen Objects in Auto-Store
Biqi Yang, Weiliang Tang, Xiaojie Gao +4
PointAugment: an Auto-Augmentation Framework for Point Cloud Classification
Ruihui Li, Xianzhi Li, Pheng-Ann Heng +1
ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay
Fanbin Lu, Zhisheng Zhong, Shu Liu +2
MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation
Jinbo Xing, Long Mai, Cusuh Ham +5
You Only Need One Thing One Click: Self-Training for Weakly Supervised 3D Scene Understanding
Zhengzhe Liu, Xiaojuan Qi, Chi-Wing Fu
Unveiling Deep Shadows: A Survey and Benchmark on Image and Video Shadow Detection, Removal, and Generation in the Deep Learning Era
Xiaowei Hu, Zhenghao Xing, Tianyu Wang +2
Patch-based Output Space Adversarial Learning for Joint Optic Disc and Cup Segmentation
Shujun Wang, Lequan Yu, Xin Yang +2
Deep Parametric 3D Filters for Joint Video Denoising and Illumination Enhancement in Video Super Resolution
Xiaogang Xu, Ruixing Wang, Chi-Wing Fu +1
TilinGNN: Learning to Tile with Self-Supervised Graph Neural Network
Hao Xu, Ka Hei Hui, Chi-Wing Fu +1
EgoHandICL: Egocentric 3D Hand Reconstruction with In-Context Learning
Binzhu Xie, Shi Qiu, Sicheng Zhang +5
COS3D: Collaborative Open-Vocabulary 3D Segmentation
Runsong Zhu, Ka-Hei Hui, Zhengzhe Liu +5
GeoManip: Geometric Constraints as General Interfaces for Robot Manipulation
Weiliang Tang, Jia-Hui Pan, Yun-Hui Liu +4
DreamStone: Image as Stepping Stone for Text-Guided 3D Shape Generation
Zhengzhe Liu, Peng Dai, Ruihui Li +2
ActFloor-GAN: Activity-Guided Adversarial Networks for Human-Centric Floorplan Design
Shidong Wang, Wei Zeng, Xi Chen +3
Hand-Shadow Poser
Hao Xu, Yinqiao Wang, Niloy J. Mitra +3
MedHallTune: An Instruction-Tuning Benchmark for Mitigating Medical Hallucination in Vision-Language Models
Qiao Yan, Yuchen Yuan, Xiaowei Hu +6
Accurate Grid Keypoint Learning for Efficient Video Prediction
Xiaojie Gao, Yueming Jin, Qi Dou +2
HybridReg: Robust 3D Point Cloud Registration with Hybrid Motions
Keyu Du, Hao Xu, Haipeng Li +3
3D-to-2D Distillation for Indoor Scene Parsing
Zhengzhe Liu, Xiaojuan Qi, Chi-Wing Fu
Instance Shadow Detection with A Single-Stage Detector
Tianyu Wang, Xiaowei Hu, Pheng-Ann Heng +1
PU-Net: Point Cloud Upsampling Network
Lequan Yu, Xianzhi Li, Chi-Wing Fu +2
CHOIR: Contact-aware 4D Hand-Object Interaction Reconstruction
Hao Xu, Yilin Liu, Yinqiao Wang +2
CNS-Edit: 3D Shape Editing via Coupled Neural Shape Optimization
Jingyu Hu, Ka-Hei Hui, Zhengzhe Liu +2
Direction-aware Spatial Context Features for Shadow Detection
Xiaowei Hu, Lei Zhu, Chi-Wing Fu +2
H-DenseUNet: Hybrid Densely Connected UNet for Liver and Tumor Segmentation from CT Volumes
Xiaomeng Li, Hao Chen, Xiaojuan Qi +3
Neural Wavelet-domain Diffusion for 3D Shape Generation
Ka-Hei Hui, Ruihui Li, Jingyu Hu +1
Towards Implicit Text-Guided 3D Shape Generation
Zhengzhe Liu, Yi Wang, Xiaojuan Qi +1
SiMA-Hand: Boosting 3D Hand-Mesh Reconstruction by Single-to-Multi-View Adaptation
Yinqiao Wang, Hao Xu, Pheng-Ann Heng +1
SILT: Shadow-aware Iterative Label Tuning for Learning to Detect Shadows from Noisy Labels
Han Yang, Tianyu Wang, Xiaowei Hu +1
CIA-SSD: Confident IoU-Aware Single-Stage Object Detector From Point Cloud
Wu Zheng, Weiliang Tang, Sijin Chen +2
Learning Reconstructability for Drone Aerial Path Planning
Yilin Liu, Liqiang Lin, Yue Hu +4
Hierarchical Point-Edge Interaction Network for Point Cloud Semantic Segmentation
Li Jiang, Hengshuang Zhao, Shu Liu +3
Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning
Hao Chen, Jiaming Liu, Chenyang Gu +8
PEGAsus: 3D Personalization of Geometry and Appearance
Jingyu Hu, Bin Hu, Ka-Hei Hui +4
PointRegGPT: Boosting 3D Point Cloud Registration using Generative Point-Cloud Pairs for Training
Suyi Chen, Hao Xu, Haipeng Li +5
Semi-signed prioritized neural fitting for surface reconstruction from unoriented point clouds
Runsong Zhu, Di Kang, Ka-Hei Hui +6
Guided Point Contrastive Learning for Semi-supervised Point Cloud Semantic Segmentation
Li Jiang, Shaoshuai Shi, Zhuotao Tian +4
Boosting 3D Object Detection by Simulating Multimodality on Point Clouds
Wu Zheng, Mingxuan Hong, Li Jiang +1
MetaShadow: Object-Centered Shadow Detection, Removal, and Synthesis
Tianyu Wang, Jianming Zhang, Haitian Zheng +7
One Thing One Click: A Self-Training Approach for Weakly Supervised 3D Semantic Segmentation
Zhengzhe Liu, Xiaojuan Qi, Chi-Wing Fu
Boosting Single-Frame 3D Object Detection by Simulating Multi-Frame Point Clouds
Wu Zheng, Li Jiang, Fanbin Lu +2
PCF-Lift: Panoptic Lifting by Probabilistic Contrastive Fusion
Runsong Zhu, Shi Qiu, Qianyi Wu +3
Native Active Perception as Reasoning for Omni-Modal Understanding
Zhenghao Xing, Ruiyang Xu, Yuxuan Wang +8
DoFE: Domain-oriented Feature Embedding for Generalizable Fundus Image Segmentation on Unseen Datasets
Shujun Wang, Lequan Yu, Kang Li +3
Rethinking Intermediate Representation for VLM-based Robot Manipulation
Weiliang Tang, Jialin Gao, Jia-Hui Pan +6
EC-Net: an Edge-aware Point set Consolidation Network
Lequan Yu, Xianzhi Li, Chi-Wing Fu +2
Boundary and Entropy-driven Adversarial Learning for Fundus Image Segmentation
Shujun Wang, Lequan Yu, Kang Li +3
Silence is Not Consensus: Disrupting Agreement Bias in Multi-Agent LLMs via Catfish Agent for Clinical Decision Making
Yihan Wang, Qiao Yan, Zhenghao Xing +5
DNF-Net: a Deep Normal Filtering Network for Mesh Denoising
Xianzhi Li, Ruihui Li, Lei Zhu +2
Instance Shadow Detection
Tianyu Wang, Xiaowei Hu, Qiong Wang +2
Towards Real-World Adverse Weather Image Restoration: Enhancing Clearness and Semantics with Vision-Language Models
Jiaqi Xu, Mengyang Wu, Xiaowei Hu +3
DisCo-Layout: Disentangling and Coordinating Semantic and Physical Refinement in a Multi-Agent Framework for 3D Indoor Layout Synthesis
Jialin Gao, Donghao Zhou, Mingjian Liang +4
LassoNet: Deep Lasso-Selection of 3D Point Clouds
Chen Zhu-Tian, Wei Zeng, Zhiguang Yang +3
FloorLevel-Net: Recognizing Floor-Level Lines with Height-Attention-Guided Multi-task Learning
Mengyang Wu, Wei Zeng, Chi-Wing Fu
GrabAR: Occlusion-aware Grabbing Virtual Objects in AR
Xiao Tang, Xiaowei Hu, Chi-Wing Fu +1
A Rotation-Invariant Framework for Deep Point Cloud Analysis
Xianzhi Li, Ruihui Li, Guangyong Chen +3
Mononizing Binocular Videos
Wenbo Hu, Menghan Xia, Chi-Wing Fu +1
Uncertainty-aware Self-ensembling Model for Semi-supervised 3D Left Atrium Segmentation
Lequan Yu, Shujun Wang, Xiaomeng Li +2
CANet: Cross-disease Attention Network for Joint Diabetic Retinopathy and Diabetic Macular Edema Grading
Xiaomeng Li, Xiaowei Hu, Lequan Yu +3
Object-level Scene Deocclusion
Zhengzhe Liu, Qing Liu, Chirui Chang +6
SP-GAN: Sphere-Guided 3D Shape Generation and Manipulation
Ruihui Li, Xianzhi Li, Ka-Hei Hui +1
On Learning the Right Attention Point for Feature Enhancement
Liqiang Lin, Pengdi Huang, Chi-Wing Fu +3
Unsupervised Detection of Distinctive Regions on 3D Shapes
Xianzhi Li, Lequan Yu, Chi-Wing Fu +2
OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation
Donghao Zhou, Guisheng Liu, Hao Yang +9
SE-SSD: Self-Ensembling Single-Stage Object Detector From Point Cloud
Wu Zheng, Weiliang Tang, Li Jiang +1
Revisiting Metric Learning for Few-Shot Image Classification
Xiaomeng Li, Lequan Yu, Chi-Wing Fu +2
A Collaborative Extended Reality Prototype for 3D Surgical Planning and Visualization
Shi Qiu, Ruiyang Li, Qixuan Liu +6
Transformation Consistent Self-ensembling Model for Semi-supervised Medical Image Segmentation
Xiaomeng Li, Lequan Yu, Hao Chen +3
Mask-ShadowGAN: Learning to Remove Shadows from Unpaired Data
Xiaowei Hu, Yitong Jiang, Chi-Wing Fu +1
Neural Wavelet-domain Diffusion for 3D Shape Generation, Inversion, and Manipulation
Jingyu Hu, Ka-Hei Hui, Zhengzhe Liu +2
EXIM: A Hybrid Explicit-Implicit Representation for Text-Guided 3D Shape Generation
Zhengzhe Liu, Jingyu Hu, Ka-Hei Hui +3
SAC-Net: Spatial Attenuation Context for Salient Object Detection
Xiaowei Hu, Chi-Wing Fu, Lei Zhu +2
CNS-Edit++: Category-Agnostic 3D Editing with Coupled Neural Shape Representation
Jingyu Hu, Weilong Yan, Zhengzhe Liu +6
PU-GAN: a Point Cloud Upsampling Adversarial Network
Ruihui Li, Xianzhi Li, Chi-Wing Fu +2
Point Cloud Upsampling via Disentangled Refinement
Ruihui Li, Xianzhi Li, Pheng-Ann Heng +1
Deep Floor Plan Recognition Using a Multi-Task Network with Room-Boundary-Guided Attention
Zhiliang Zeng, Xianzhi Li, Ying Kin Yu +1
CvhSlicer 2.0: Immersive and Interactive Visualization of Chinese Visible Human Data in XR Environments
Yue Qiu, Yuqi Tong, Yu Zhang +5
Rethinking End-to-End 2D to 3D Scene Segmentation in Gaussian Splatting
Runsong Zhu, Shi Qiu, Zhengzhe Liu +4
Not-So-Optimal Transport Flows for 3D Point Cloud Generation
Ka-Hei Hui, Chao Liu, Xiaohui Zeng +2
Multi-Task Recurrent Convolutional Network with Correlation Loss for Surgical Video Analysis
Yueming Jin, Huaxia Li, Qi Dou +4
UrbanBIS: a Large-scale Benchmark for Fine-grained Urban Building Instance Segmentation
Guoqing Yang, Fuyou Xue, Qi Zhang +3
Coordinated 2D-3D Visualization of Volumetric Medical Data in XR with Multimodal Interactions
Qixuan Liu, Shi Qiu, Yinqiao Wang +4
UniHOPE: A Unified Approach for Hand-Only and Hand-Object Pose Estimation
Yinqiao Wang, Hao Xu, Pheng-Ann Heng +1
Overcoming Support Dilution for Robust Few-shot Semantic Segmentation
Wailing Tang, Biqi Yang, Pheng-Ann Heng +2
Towards High-quality Visualization of Superfluid Vortices
Yulong Guo, Xiaopei Liu, Chi Xiong +2
IdentityStory: Taming Your Identity-Preserving Generator for Human-Centric Story Generation
Donghao Zhou, Jingyu Lin, Guibao Shen +8
Incentivizing Multimodal Reasoning in Large Models for Direct Robot Manipulation
Weiliang Tang, Dong Jing, Jia-Hui Pan +5
Make-A-Shape: a Ten-Million-scale 3D Shape Model
Ka-Hei Hui, Aditya Sanghi, Arianna Rampini +4
OpenView: Empowering MLLMs with Out-of-view VQA
Qixiang Chen, Cheng Zhang, Chi-Wing Fu +2
Neural Template: Topology-aware Reconstruction and Disentangled Generation of 3D Meshes
Ka-Hei Hui, Ruihui Li, Jingyu Hu +1
ICM-Assistant: Instruction-tuning Multimodal Large Language Models for Rule-based Explainable Image Content Moderation
Mengyang Wu, Yuzhi Zhao, Jialun Cao +7
The Liver Tumor Segmentation Benchmark (LiTS)
Patrick Bilic, Patrick Christ, Hongwei Bran Li +106
Semi-supervised Skin Lesion Segmentation via Transformation Consistent Self-ensembling Model
Xiaomeng Li, Lequan Yu, Hao Chen +2
Video Instance Shadow Detection Under the Sun and Sky
Zhenghao Xing, Tianyu Wang, Xiaowei Hu +3
Revisiting Shadow Detection: A New Benchmark Dataset for Complex World
Xiaowei Hu, Tianyu Wang, Chi-Wing Fu +3
PointGroup: Dual-Set Point Grouping for 3D Instance Segmentation
Li Jiang, Hengshuang Zhao, Shaoshuai Shi +3
STEVE: A Step Verification Pipeline for Computer-use Agent Training
Fanbin Lu, Zhisheng Zhong, Ziqin Wei +3
Embodiment-Agnostic Action Planning via Object-Part Scene Flow
Weiliang Tang, Jia-Hui Pan, Wei Zhan +6
ISS: Image as Stepping Stone for Text-Guided 3D Shape Generation
Zhengzhe Liu, Peng Dai, Ruihui Li +2
Learning from Extrinsic and Intrinsic Supervisions for Domain Generalization
Shujun Wang, Lequan Yu, Caizi Li +2