Publications (74)
Bringing Rolling Shutter Images Alive with Dual Reversed Distortion
Zhihang Zhong, Mingdeng Cao, Xiao Sun +5
You Only Need Less Attention at Each Stage in Vision Transformers
Shuoxi Zhang, Hanpeng Liu, Stephen Lin +1
Global Context Networks
Yue Cao, Jiarui Xu, Stephen Lin +2
Exploring Transferability for Randomized Smoothing
Kai Qiu, Huishuai Zhang, Zhirong Wu +1
Aligning Pretraining for Detection via Object-Level Contrastive Learning
Fangyun Wei, Yue Gao, Zhirong Wu +2
Deformable ConvNets v2: More Deformable, Better Results
Xizhou Zhu, Han Hu, Stephen Lin +1
Swin Transformer: Hierarchical Vision Transformer using Shifted Windows
Ze Liu, Yutong Lin, Yue Cao +5
GCNet: Non-local Networks Meet Squeeze-Excitation Networks and Beyond
Yue Cao, Jiarui Xu, Stephen Lin +2
Exposure: A White-Box Photo Post-Processing Framework
Yuanming Hu, Hao He, Chenxi Xu +2
Cross-Model Pseudo-Labeling for Semi-Supervised Action Recognition
Yinghao Xu, Fangyun Wei, Xiao Sun +5
Learning Residual Flow as Dynamic Motion from Stereo Videos
Seokju Lee, Sunghoon Im, Stephen Lin +1
Cost Aggregation with 4D Convolutional Swin Transformer for Few-Shot Segmentation
Sunghwan Hong, Seokju Cho, Jisu Nam +2
Single Image Reflection Removal through Cascaded Refinement
Chao Li, Yixiao Yang, Kun He +2
Instance-wise Depth and Motion Learning from Monocular Videos
Seokju Lee, Sunghoon Im, Stephen Lin +1
Associative Transformer
Yuwei Sun, Hideya Ochiai, Zhirong Wu +2
Animation from Blur: Multi-modal Blur Decomposition with Motion Guidance
Zhihang Zhong, Xiao Sun, Zhirong Wu +3
Explicit Spatiotemporal Joint Relation Learning for Tracking Human Pose
Xiao Sun, Chuankang Li, Stephen Lin
Unified Depth Prediction and Intrinsic Image Decomposition from a Single Image via Joint Convolutional Neural Fields
Seungryong Kim, Kihong Park, Kwanghoon Sohn +1
GMConv: Modulating Effective Receptive Fields for Convolutional Kernels
Qi Chen, Chao Li, Jia Ning +2
Unsupervised Learning of Efficient Geometry-Aware Neural Articulated Representations
Atsuhiro Noguchi, Xiao Sun, Stephen Lin +1
Unsupervised Extraction of Video Highlights Via Robust Recurrent Auto-encoders
Huan Yang, Baoyuan Wang, Stephen Lin +3
Propagate Yourself: Exploring Pixel-Level Consistency for Unsupervised Visual Representation Learning
Zhenda Xie, Yutong Lin, Zheng Zhang +3
Multi-Context Deep Network for Angle-Closure Glaucoma Screening in Anterior Segment OCT
Huazhu Fu, Yanwu Xu, Stephen Lin +5
A Simple Multi-Modality Transfer Learning Baseline for Sign Language Translation
Yutong Chen, Fangyun Wei, Xiao Sun +2
FCSS: Fully Convolutional Self-Similarity for Dense Semantic Correspondence
Seungryong Kim, Dongbo Min, Bumsub Ham +3
Neural Articulated Radiance Field
Atsuhiro Noguchi, Xiao Sun, Stephen Lin +1
ClipCrop: Conditioned Cropping Driven by Vision-Language Model
Zhihang Zhong, Mingxi Cheng, Zhirong Wu +7
The Emergence of Objectness: Learning Zero-Shot Segmentation from Videos
Runtao Liu, Zhirong Wu, Stella X. Yu +1
RepPoints: Point Set Representation for Object Detection
Ze Yang, Shaohui Liu, Han Hu +2
Randomized Quantization: A Generic Augmentation for Data Agnostic Self-supervised Learning
Huimin Wu, Chenyang Lei, Xiao Sun +5
Deep Self-Convolutional Activations Descriptor for Dense Cross-Modal Correspondence
Seungryong Kim, Dongbo Min, Stephen Lin +1
Unifying Feature and Cost Aggregation with Transformers for Semantic and Visual Correspondence
Sunghwan Hong, Seokju Cho, Seungryong Kim +1
Detecting Human-Object Interactions with Action Co-occurrence Priors
Dong-Jin Kim, Xiao Sun, Jinsoo Choi +2
A Study of Finetuning Video Transformers for Multi-view Geometry Tasks
Huimin Wu, Kwang-Ting Cheng, Stephen Lin +1
Could Giant Pretrained Image Models Extract Universal Representations?
Yutong Lin, Ze Liu, Zheng Zhang +4
Cross-Iteration Batch Normalization
Zhuliang Yao, Yue Cao, Shuxin Zheng +2
Angle-Closure Detection in Anterior Segment OCT based on Multi-Level Deep Network
Huazhu Fu, Yanwu Xu, Stephen Lin +5
Point-Set Anchors for Object Detection, Instance Segmentation and Pose Estimation
Fangyun Wei, Xiao Sun, Hongyang Li +2
Integrative Feature and Cost Aggregation with Transformers for Dense Correspondence
Sunghwan Hong, Seokju Cho, Seungryong Kim +1
Disentangled Non-Local Neural Networks
Minghao Yin, Zhuliang Yao, Yue Cao +4
An Empirical Study of Spatial Attention Mechanisms in Deep Networks
Xizhou Zhu, Dazhi Cheng, Zheng Zhang +2
Image to Pseudo-Episode: Boosting Few-Shot Segmentation by Unlabeled Data
Jie Zhang, Yuhan Li, Yude Wang +2
Deep Metric Transfer for Label Propagation with Limited Annotated Data
Bin Liu, Zhirong Wu, Han Hu +1
Extreme Masking for Learning Instance and Distributed Visual Representations
Zhirong Wu, Zihang Lai, Xiao Sun +1
Recurrent Transformer Networks for Semantic Correspondence
Seungryong Kim, Stephen Lin, Sangryul Jeon +2
Distilling Localization for Self-Supervised Representation Learning
Nanxuan Zhao, Zhirong Wu, Rynson W. H. Lau +1
Spatially Adaptive Inference with Stochastic Feature Sampling and Interpolation
Zhenda Xie, Zheng Zhang, Xizhou Zhu +2
Local Relation Networks for Image Recognition
Han Hu, Zheng Zhang, Zhenda Xie +1
An Integral Pose Regression System for the ECCV2018 PoseTrack Challenge
Xiao Sun, Chuankang Li, Stephen Lin
Faces as Lighting Probes via Unsupervised Deep Highlight Extraction
Renjiao Yi, Chenyang Zhu, Ping Tan +1
Learning Monocular Depth in Dynamic Scenes via Instance-Aware Projection Consistency
Seokju Lee, Sunghoon Im, Stephen Lin +1
Dense RepPoints: Representing Visual Objects with Dense Point Sets
Ze Yang, Yinghao Xu, Han Xue +5
Region Rebalance for Long-Tailed Semantic Segmentation
Jiequan Cui, Yuhui Yuan, Zhisheng Zhong +4
NuTime: Numerically Multi-Scaled Embedding for Large-Scale Time-Series Pretraining
Chenguo Lin, Xumeng Wen, Wei Cao +4
Visuomotor Understanding for Representation Learning of Driving Scenes
Seokju Lee, Junsik Kim, Tae-Hyun Oh +4
Steering Vision-Language Pre-trained Models for Incremental Face Presentation Attack Detection
Haoze Li, Jie Zhang, Guoying Zhao +2
Instance Localization for Self-supervised Detection Pretraining
Ceyuan Yang, Zhirong Wu, Bolei Zhou +1
What makes instance discrimination good for transfer learning?
Nanxuan Zhao, Zhirong Wu, Rynson W. H. Lau +1
Object-based Illumination Estimation with Rendering-aware Neural Networks
Xin Wei, Guojun Chen, Yue Dong +2
Towards Tokenized Human Dynamics Representation
Kenneth Li, Xiao Sun, Zhirong Wu +2
DPSNet: End-to-end Deep Plane Sweep Stereo
Sunghoon Im, Hae-Gon Jeon, Stephen Lin +1
Integrated Object Detection and Tracking with Tracklet-Conditioned Detection
Zheng Zhang, Dazhi Cheng, Xizhou Zhu +2
Collaboratively Self-supervised Video Representation Learning for Action Recognition
Jie Zhang, Zhifan Wan, Lanqing Hu +3
Leveraging Multi-view Image Sets for Unsupervised Intrinsic Image Decomposition and Highlight Separation
Renjiao Yi, Ping Tan, Stephen Lin
DCTM: Discrete-Continuous Transformation Matching for Semantic Flow
Seungryong Kim, Dongbo Min, Stephen Lin +1
ACP++: Action Co-occurrence Priors for Human-Object Interaction Detection
Dong-Jin Kim, Xiao Sun, Jinsoo Choi +2
Local Magnification for Data and Feature Augmentation
Kun He, Chang Liu, Stephen Lin +1
RepPoints V2: Verification Meets Regression for Object Detection
Yihong Chen, Zheng Zhang, Yue Cao +3
Seeing Beyond Haze: Generative Nighttime Image Dehazing
Beibei Lin, Stephen Lin, Robby Tan
Mimicking the In-Camera Color Pipeline for Camera-Aware Object Compositing
Jun Gao, Xiao Li, Liwei Wang +2
Bootstrap Your Object Detector via Mixed Training
Mengde Xu, Zheng Zhang, Fangyun Wei +5
A Transductive Approach for Video Object Segmentation
Yizhuo Zhang, Zhirong Wu, Houwen Peng +1
SRNet: Improving Generalization in 3D Human Pose Estimation with a Split-and-Recombine Approach
Ailing Zeng, Xiao Sun, Fuyang Huang +3
Video Swin Transformer
Ze Liu, Jia Ning, Yue Cao +4