papers

Publications (74)

cs.CV2022

Bringing Rolling Shutter Images Alive with Dual Reversed Distortion

Zhihang Zhong, Mingdeng Cao, Xiao Sun +5

cs.CV2024

You Only Need Less Attention at Each Stage in Vision Transformers

Shuoxi Zhang, Hanpeng Liu, Stephen Lin +1

cs.CV2020

Global Context Networks

Yue Cao, Jiarui Xu, Stephen Lin +2

cs.CV2023

Exploring Transferability for Randomized Smoothing

Kai Qiu, Huishuai Zhang, Zhirong Wu +1

cs.CV2021

Aligning Pretraining for Detection via Object-Level Contrastive Learning

Fangyun Wei, Yue Gao, Zhirong Wu +2

cs.CV2018

Deformable ConvNets v2: More Deformable, Better Results

Xizhou Zhu, Han Hu, Stephen Lin +1

cs.CV2021

Swin Transformer: Hierarchical Vision Transformer using Shifted Windows

Ze Liu, Yutong Lin, Yue Cao +5

cs.CV2019

GCNet: Non-local Networks Meet Squeeze-Excitation Networks and Beyond

Yue Cao, Jiarui Xu, Stephen Lin +2

cs.GR2018

Exposure: A White-Box Photo Post-Processing Framework

Yuanming Hu, Hao He, Chenxi Xu +2

cs.CV2022

Cross-Model Pseudo-Labeling for Semi-Supervised Action Recognition

Yinghao Xu, Fangyun Wei, Xiao Sun +5

cs.CV2019

Learning Residual Flow as Dynamic Motion from Stereo Videos

Seokju Lee, Sunghoon Im, Stephen Lin +1

cs.CV2022

Cost Aggregation with 4D Convolutional Swin Transformer for Few-Shot Segmentation

Sunghwan Hong, Seokju Cho, Jisu Nam +2

cs.CV2020

Single Image Reflection Removal through Cascaded Refinement

Chao Li, Yixiao Yang, Kun He +2

cs.CV2020

Instance-wise Depth and Motion Learning from Monocular Videos

Seokju Lee, Sunghoon Im, Stephen Lin +1

cs.LG2025

Associative Transformer

Yuwei Sun, Hideya Ochiai, Zhirong Wu +2

cs.CV2022

Animation from Blur: Multi-modal Blur Decomposition with Motion Guidance

Zhihang Zhong, Xiao Sun, Zhirong Wu +3

cs.CV2019

Explicit Spatiotemporal Joint Relation Learning for Tracking Human Pose

Xiao Sun, Chuankang Li, Stephen Lin

cs.CV2016

Unified Depth Prediction and Intrinsic Image Decomposition from a Single Image via Joint Convolutional Neural Fields

Seungryong Kim, Kihong Park, Kwanghoon Sohn +1

cs.CV2023

GMConv: Modulating Effective Receptive Fields for Convolutional Kernels

Qi Chen, Chao Li, Jia Ning +2

cs.CV2022

Unsupervised Learning of Efficient Geometry-Aware Neural Articulated Representations

Atsuhiro Noguchi, Xiao Sun, Stephen Lin +1

cs.CV2015

Unsupervised Extraction of Video Highlights Via Robust Recurrent Auto-encoders

Huan Yang, Baoyuan Wang, Stephen Lin +3

cs.CV2021

Propagate Yourself: Exploring Pixel-Level Consistency for Unsupervised Visual Representation Learning

Zhenda Xie, Yutong Lin, Zheng Zhang +3

cs.CV2018

Multi-Context Deep Network for Angle-Closure Glaucoma Screening in Anterior Segment OCT

Huazhu Fu, Yanwu Xu, Stephen Lin +5

cs.CV2023

A Simple Multi-Modality Transfer Learning Baseline for Sign Language Translation

Yutong Chen, Fangyun Wei, Xiao Sun +2

cs.CV2017

FCSS: Fully Convolutional Self-Similarity for Dense Semantic Correspondence

Seungryong Kim, Dongbo Min, Bumsub Ham +3

cs.CV2021

Neural Articulated Radiance Field

Atsuhiro Noguchi, Xiao Sun, Stephen Lin +1

cs.CV2022

ClipCrop: Conditioned Cropping Driven by Vision-Language Model

Zhihang Zhong, Mingxi Cheng, Zhirong Wu +7

cs.CV2021

The Emergence of Objectness: Learning Zero-Shot Segmentation from Videos

Runtao Liu, Zhirong Wu, Stella X. Yu +1

cs.CV2019

RepPoints: Point Set Representation for Object Detection

Ze Yang, Shaohui Liu, Han Hu +2

cs.CV2023

Randomized Quantization: A Generic Augmentation for Data Agnostic Self-supervised Learning

Huimin Wu, Chenyang Lei, Xiao Sun +5

cs.CV2016

Deep Self-Convolutional Activations Descriptor for Dense Cross-Modal Correspondence

Seungryong Kim, Dongbo Min, Stephen Lin +1

cs.CV2024

Unifying Feature and Cost Aggregation with Transformers for Semantic and Visual Correspondence

Sunghwan Hong, Seokju Cho, Seungryong Kim +1

cs.CV2020

Detecting Human-Object Interactions with Action Co-occurrence Priors

Dong-Jin Kim, Xiao Sun, Jinsoo Choi +2

cs.CV2025

A Study of Finetuning Video Transformers for Multi-view Geometry Tasks

Huimin Wu, Kwang-Ting Cheng, Stephen Lin +1

cs.CV2022

Could Giant Pretrained Image Models Extract Universal Representations?

Yutong Lin, Ze Liu, Zheng Zhang +4

cs.LG2021

Cross-Iteration Batch Normalization

Zhuliang Yao, Yue Cao, Shuxin Zheng +2

cs.CV2019

Angle-Closure Detection in Anterior Segment OCT based on Multi-Level Deep Network

Huazhu Fu, Yanwu Xu, Stephen Lin +5

cs.CV2020

Point-Set Anchors for Object Detection, Instance Segmentation and Pose Estimation

Fangyun Wei, Xiao Sun, Hongyang Li +2

cs.CV2022

Integrative Feature and Cost Aggregation with Transformers for Dense Correspondence

Sunghwan Hong, Seokju Cho, Seungryong Kim +1

cs.CV2020

Disentangled Non-Local Neural Networks

Minghao Yin, Zhuliang Yao, Yue Cao +4

cs.CV2019

An Empirical Study of Spatial Attention Mechanisms in Deep Networks

Xizhou Zhu, Dazhi Cheng, Zheng Zhang +2

cs.CV2024

Image to Pseudo-Episode: Boosting Few-Shot Segmentation by Unlabeled Data

Jie Zhang, Yuhan Li, Yude Wang +2

cs.CV2019

Deep Metric Transfer for Label Propagation with Limited Annotated Data

Bin Liu, Zhirong Wu, Han Hu +1

cs.CV2023

Extreme Masking for Learning Instance and Distributed Visual Representations

Zhirong Wu, Zihang Lai, Xiao Sun +1

cs.CV2018

Recurrent Transformer Networks for Semantic Correspondence

Seungryong Kim, Stephen Lin, Sangryul Jeon +2

cs.CV2021

Distilling Localization for Self-Supervised Representation Learning

Nanxuan Zhao, Zhirong Wu, Rynson W. H. Lau +1

cs.CV2020

Spatially Adaptive Inference with Stochastic Feature Sampling and Interpolation

Zhenda Xie, Zheng Zhang, Xizhou Zhu +2

cs.CV2019

Local Relation Networks for Image Recognition

Han Hu, Zheng Zhang, Zhenda Xie +1

cs.CV2018

An Integral Pose Regression System for the ECCV2018 PoseTrack Challenge

Xiao Sun, Chuankang Li, Stephen Lin

cs.CV2018

Faces as Lighting Probes via Unsupervised Deep Highlight Extraction

Renjiao Yi, Chenyang Zhu, Ping Tan +1

cs.CV2021

Learning Monocular Depth in Dynamic Scenes via Instance-Aware Projection Consistency

Seokju Lee, Sunghoon Im, Stephen Lin +1

cs.CV2020

Dense RepPoints: Representing Visual Objects with Dense Point Sets

Ze Yang, Yinghao Xu, Han Xue +5

cs.CV2022

Region Rebalance for Long-Tailed Semantic Segmentation

Jiequan Cui, Yuhui Yuan, Zhisheng Zhong +4

cs.LG2024

NuTime: Numerically Multi-Scaled Embedding for Large-Scale Time-Series Pretraining

Chenguo Lin, Xumeng Wen, Wei Cao +4

cs.CV2019

Visuomotor Understanding for Representation Learning of Driving Scenes

Seokju Lee, Junsik Kim, Tae-Hyun Oh +4

cs.CV2025

Steering Vision-Language Pre-trained Models for Incremental Face Presentation Attack Detection

Haoze Li, Jie Zhang, Guoying Zhao +2

cs.CV2021

Instance Localization for Self-supervised Detection Pretraining

Ceyuan Yang, Zhirong Wu, Bolei Zhou +1

cs.CV2021

What makes instance discrimination good for transfer learning?

Nanxuan Zhao, Zhirong Wu, Rynson W. H. Lau +1

cs.CV2020

Object-based Illumination Estimation with Rendering-aware Neural Networks

Xin Wei, Guojun Chen, Yue Dong +2

cs.CV2021

Towards Tokenized Human Dynamics Representation

Kenneth Li, Xiao Sun, Zhirong Wu +2

cs.CV2019

DPSNet: End-to-end Deep Plane Sweep Stereo

Sunghoon Im, Hae-Gon Jeon, Stephen Lin +1

cs.CV2018

Integrated Object Detection and Tracking with Tracklet-Conditioned Detection

Zheng Zhang, Dazhi Cheng, Xizhou Zhu +2

cs.CV2025

Collaboratively Self-supervised Video Representation Learning for Action Recognition

Jie Zhang, Zhifan Wan, Lanqing Hu +3

cs.CV2019

Leveraging Multi-view Image Sets for Unsupervised Intrinsic Image Decomposition and Highlight Separation

Renjiao Yi, Ping Tan, Stephen Lin

cs.CV2017

DCTM: Discrete-Continuous Transformation Matching for Semantic Flow

Seungryong Kim, Dongbo Min, Stephen Lin +1

cs.CV2021

ACP++: Action Co-occurrence Priors for Human-Object Interaction Detection

Dong-Jin Kim, Xiao Sun, Jinsoo Choi +2

cs.CV2022

Local Magnification for Data and Feature Augmentation

Kun He, Chang Liu, Stephen Lin +1

cs.CV2020

RepPoints V2: Verification Meets Regression for Object Detection

Yihong Chen, Zheng Zhang, Yue Cao +3

cs.CV2025

Seeing Beyond Haze: Generative Nighttime Image Dehazing

Beibei Lin, Stephen Lin, Robby Tan

cs.CV2019

Mimicking the In-Camera Color Pipeline for Camera-Aware Object Compositing

Jun Gao, Xiao Li, Liwei Wang +2

cs.CV2021

Bootstrap Your Object Detector via Mixed Training

Mengde Xu, Zheng Zhang, Fangyun Wei +5

cs.CV2020

A Transductive Approach for Video Object Segmentation

Yizhuo Zhang, Zhirong Wu, Houwen Peng +1

cs.CV2020

SRNet: Improving Generalization in 3D Human Pose Estimation with a Split-and-Recombine Approach

Ailing Zeng, Xiao Sun, Fuyang Huang +3

cs.CV2021

Video Swin Transformer

Ze Liu, Jia Ning, Yue Cao +4