Publications (156)
Cyclically Disentangled Feature Translation for Face Anti-spoofing
Haixiao Yue, Keyao Wang, Guosheng Zhang +4
Few-Shot Font Generation by Learning Fine-Grained Local Styles
Licheng Tang, Yiyang Cai, Jiaming Liu +7
LaMI-DETR: Open-Vocabulary Detection with Language Model Instruction
Penghui Du, Yu Wang, Yifan Sun +7
Image Inpainting by End-to-End Cascaded Refinement with Mask Awareness
Manyu Zhu, Dongliang He, Xin Li +5
Decoupled Pseudo-labeling for Semi-Supervised Monocular 3D Object Detection
Jiacheng Zhang, Jiaming Li, Xiangru Lin +6
Few-Shot Head Swapping in the Wild
Changyong Shu, Hemao Wu, Hang Zhou +7
MixFormer: Mixing Features across Windows and Dimensions
Qiang Chen, Qiman Wu, Jian Wang +5
Group Pose: A Simple Baseline for End-to-End Multi-person Pose Estimation
Huan Liu, Qiang Chen, Zichang Tan +9
ACFNet: Attentional Class Feature Network for Semantic Segmentation
Fan Zhang, Yanqin Chen, Zhihang Li +5
Part-aware Prototypical Graph Network for One-shot Skeleton-based Action Recognition
Tailin Chen, Desen Zhou, Jian Wang +6
ICDAR 2023 Competition on Structured Text Extraction from Visually-Rich Document Images
Wenwen Yu, Chengquan Zhang, Haoyu Cao +24
Understanding Image Retrieval Re-Ranking: A Graph Neural Network Perspective
Xuanmeng Zhang, Minyue Jiang, Zhedong Zheng +3
Dual-stream Network for Visual Recognition
Mingyuan Mao, Renrui Zhang, Honghui Zheng +6
Splatter-360: Generalizable 360$^{\circ}$ Gaussian Splatting for Wide-baseline Panoramic Images
Zheng Chen, Chenming Wu, Zhelun Shen +5
Building an Invisible Shield for Your Portrait against Deepfakes
Jiazhi Guan, Tianshu Hu, Hang Zhou +5
CAPE: Camera View Position Embedding for Multi-View 3D Object Detection
Kaixin Xiong, Shi Gong, Xiaoqing Ye +5
StrucTexT: Structured Text Understanding with Multi-Modal Transformers
Yulin Li, Yuxi Qian, Yuchen Yu +7
Look More Than Once: An Accurate Detector for Text of Arbitrary Shapes
Chengquan Zhang, Borong Liang, Zuming Huang +4
GIR: 3D Gaussian Inverse Rendering for Relightable Scene Factorization
Yahao Shi, Yanmin Wu, Chenming Wu +7
Predict, Prevent, and Evaluate: Disentangled Text-Driven Image Manipulation Empowered by Pre-Trained Vision-Language Model
Zipeng Xu, Tianwei Lin, Hao Tang +6
ASCNet: Self-supervised Video Representation Learning with Appearance-Speed Consistency
Deng Huang, Wenhao Wu, Weiwen Hu +6
Delicate Textured Mesh Recovery from NeRF via Adaptive Surface Refinement
Jiaxiang Tang, Hang Zhou, Xiaokang Chen +4
HD-Fusion: Detailed Text-to-3D Generation Leveraging Multiple Noise Estimation
Jinbo Wu, Xiaobo Gao, Xing Liu +5
FaceController: Controllable Attribute Editing for Face in the Wild
Zhiliang Xu, Xiyu Yu, Zhibin Hong +5
An Information Theory-inspired Strategy for Automatic Network Pruning
Xiawu Zheng, Yuexiao Ma, Teng Xi +6
Interpretable Face Anti-Spoofing: Enhancing Generalization with Multimodal Large Language Models
Guosheng Zhang, Keyao Wang, Haixiao Yue +5
Segment as Points for Efficient Online Multi-Object Tracking and Segmentation
Zhenbo Xu, Wei Zhang, Xiao Tan +5
OpenGaussian: Towards Point-Level 3D Gaussian-based Open Vocabulary Understanding
Yanmin Wu, Jiarui Meng, Haijie Li +8
GVA: Reconstructing Vivid 3D Gaussian Avatars from Monocular Videos
Xinqi Liu, Chenming Wu, Jialun Liu +6
A Single-Shot Arbitrarily-Shaped Text Detector based on Context Attended Multi-Task Learning
Pengfei Wang, Chengquan Zhang, Fei Qi +6
NTIRE 2020 Challenge on Real Image Denoising: Dataset, Methods and Results
Abdelrahman Abdelhamed, Mahmoud Afifi, Radu Timofte +87
AGO-Net: Association-Guided 3D Point Cloud Object Detection Network
Liang Du, Xiaoqing Ye, Xiao Tan +5
Rope3D: TheRoadside Perception Dataset for Autonomous Driving and Monocular 3D Object Detection Task
Xiaoqing Ye, Mao Shu, Hanyu Li +5
StyleSwap: Style-Based Generator Empowers Robust Face Swapping
Zhiliang Xu, Hang Zhou, Zhibin Hong +7
Delving into Sequential Patches for Deepfake Detection
Jiazhi Guan, Hang Zhou, Zhibin Hong +4
Boosting Video-Text Retrieval with Explicit High-Level Semantics
Haoran Wang, Di Xu, Dongliang He +4
PAFNet: An Efficient Anchor-Free Object Detector Guidance
Ying Xin, Guanzhong Wang, Mingyuan Mao +5
Re-HOLD: Video Hand Object Interaction Reenactment via adaptive Layout-instructed Diffusion Model
Yingying Fan, Quanwei Yang, Kaisiyuan Wang +6
UFO: Unified Feature Optimization
Teng Xi, Yifan Sun, Deli Yu +13
Unsupervised Multi-Source Domain Adaptation for Person Re-Identification
Zechen Bai, Zhigang Wang, Jian Wang +2
AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
Jiazhi Guan, Kaisiyuan Wang, Zhiliang Xu +12
PointTrack++ for Effective Online Multi-Object Tracking and Segmentation
Zhenbo Xu, Wei Zhang, Xiao Tan +7
Accelerating Vision Transformers Based on Heterogeneous Attention Patterns
Deli Yu, Teng Xi, Jianwei Li +7
ICDAR 2019 Competition on Large-scale Street View Text with Partial Labeling -- RRC-LSVT
Yipeng Sun, Zihan Ni, Chee-Kheng Chng +9
TexRO: Generating Delicate Textures of 3D Models by Recursive Optimization
Jinbo Wu, Xing Liu, Chenming Wu +7
OVLW-DETR: Open-Vocabulary Light-Weighted Detection Transformer
Yu Wang, Xiangbo Su, Qiang Chen +6
ICDAR2019 Robust Reading Challenge on Arbitrary-Shaped Text (RRC-ArT)
Chee-Kheng Chng, Yuliang Liu, Yipeng Sun +11
OPEN: Object-wise Position Embedding for Multi-view 3D Object Detection
Jinghua Hou, Tong Wang, Xiaoqing Ye +6
Dynamic Instance Normalization for Arbitrary Style Transfer
Yongcheng Jing, Xiao Liu, Yukang Ding +4
WordSup: Exploiting Word Annotations for Character based Text Detection
Han Hu, Chengquan Zhang, Yuxuan Luo +3
Group DETR: Fast DETR Training with Group-Wise One-to-Many Assignment
Qiang Chen, Xiaokang Chen, Jian Wang +7
Student-Teacher Feature Pyramid Matching for Anomaly Detection
Guodong Wang, Shumin Han, Errui Ding +1
Beyond Self-Supervision: A Simple Yet Effective Network Distillation Alternative to Improve Backbones
Cheng Cui, Ruoyu Guo, Yuning Du +10
An End-to-end Video Text Detector with Online Tracking
Hongyuan Yu, Chengquan Zhang, Xuan Li +3
Multi-Attention Multi-Class Constraint for Fine-grained Image Recognition
Ming Sun, Yuchen Yuan, Feng Zhou +1
PP-YOLO: An Effective and Efficient Implementation of Object Detector
Xiang Long, Kaipeng Deng, Guanzhong Wang +8
Singular Value Fine-tuning: Few-shot Segmentation requires Few-parameters Fine-tuning
Yanpeng Sun, Qiang Chen, Xiangyu He +7
Editing Text in the Wild
Liang Wu, Chengquan Zhang, Jiaming Liu +4
Drafting and Revision: Laplacian Pyramid Network for Fast High-Quality Artistic Style Transfer
Tianwei Lin, Zhuoqi Ma, Fu Li +6
TexGaussian: Generating High-quality PBR Material via Octree-based 3D Gaussian Splatting
Bojun Xiong, Jialun Liu, Jiakui Hu +6
Neural Color Operators for Sequential Image Retouching
Yili Wang, Xin Li, Kun Xu +4
RTFormer: Efficient Design for Real-Time Semantic Segmentation with Transformer
Jian Wang, Chenhui Gou, Qiman Wu +4
Explanatory Instructions: Towards Unified Vision Tasks Understanding and Zero-shot Generalization
Yang Shen, Xiu-Shen Wei, Yifan Sun +6
Learning Multi-Granular Spatio-Temporal Graph Network for Skeleton-based Action Recognition
Tailin Chen, Desen Zhou, Jian Wang +4
Real Image Super Resolution Via Heterogeneous Model Ensemble using GP-NAS
Zhihong Pan, Baopu Li, Teng Xi +5
Coherent Loss: A Generic Framework for Stable Video Segmentation
Mingyang Qian, Yi Fu, Xiao Tan +5
KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling
Yu Wang, Xin Li, Shengzhao Weng +5
Uni$^2$Det: Unified and Universal Framework for Prompt-Guided Multi-dataset 3D Detection
Yubin Wang, Zhikang Zou, Xiaoqing Ye +3
HAMBox: Delving into Online High-quality Anchors Mining for Detecting Outer Faces
Yang Liu, Xu Tang, Xiang Wu +3
Action Quality Assessment with Temporal Parsing Transformer
Yang Bai, Desen Zhou, Songyang Zhang +5
Discriminative Sounding Objects Localization via Self-supervised Audiovisual Matching
Di Hu, Rui Qian, Minyue Jiang +5
LMR: A Large-Scale Multi-Reference Dataset for Reference-based Super-Resolution
Lin Zhang, Xin Li, Dongliang He +2
U-HRNet: Delving into Improving Semantic Representation of High Resolution Network for Dense Prediction
Jian Wang, Xiang Long, Guowei Chen +3
Fine-grained Video Categorization with Redundancy Reduction Attention
Chen Zhu, Xiao Tan, Feng Zhou +4
Masked Lip-Sync Prediction by Audio-Visual Contextual Exploitation in Transformers
Yasheng Sun, Hang Zhou, Kaisiyuan Wang +7
Adversarial Dual-Student with Differentiable Spatial Warping for Semi-Supervised Semantic Segmentation
Cong Cao, Tianwei Lin, Dongliang He +4
Chinese Street View Text: Large-scale Chinese Text Reading with Partially Supervised Learning
Yipeng Sun, Jiaming Liu, Wei Liu +3
Localizing by Describing: Attribute-Guided Attention Localization for Fine-Grained Recognition
Xiao Liu, Jiang Wang, Shilei Wen +2
Paint and Distill: Boosting 3D Object Detection with Semantic Passing Network
Bo Ju, Zhikang Zou, Xiaoqing Ye +4
STGAN: A Unified Selective Transfer Network for Arbitrary Image Attribute Editing
Ming Liu, Yukang Ding, Min Xia +4
StrucTexTv2: Masked Visual-Textual Prediction for Document Image Pre-training
Yuechen Yu, Yulin Li, Chengquan Zhang +7
TALK-Act: Enhance Textural-Awareness for 2D Speaking Avatar Reenactment with Diffusion Model
Jiazhi Guan, Quanwei Yang, Kaisiyuan Wang +9
VideoGen: A Reference-Guided Latent Diffusion Approach for High Definition Text-to-Video Generation
Xin Li, Wenqing Chu, Ye Wu +7
GitNet: Geometric Prior-based Transformation for Birds-Eye-View Segmentation
Shi Gong, Xiaoqing Ye, Xiao Tan +4
Semi-DETR: Semi-Supervised Object Detection with Detection Transformers
Jiacheng Zhang, Xiangru Lin, Wei Zhang +6
ALoRE: Efficient Visual Adaptation via Aggregating Low Rank Experts
Sinan Du, Guosheng Zhang, Keyao Wang +7
Graph Contrastive Learning for Skeleton-based Action Recognition
Xiaohu Huang, Hao Zhou, Jian Wang +7
CAE v2: Context Autoencoder with CLIP Target
Xinyu Zhang, Jiahui Chen, Junkun Yuan +10
Learning Generalized Spoof Cues for Face Anti-spoofing
Haocheng Feng, Zhibin Hong, Haixiao Yue +5
Group DETR v2: Strong Object Detector with Encoder-Decoder Pretraining
Qiang Chen, Jian Wang, Chuchu Han +12
BMN: Boundary-Matching Network for Temporal Action Proposal Generation
Tianwei Lin, Xiao Liu, Xin Li +2
VRP-SAM: SAM with Visual Reference Prompt
Yanpeng Sun, Jiahui Chen, Shan Zhang +7
Dynamic Class Queue for Large Scale Face Recognition In the Wild
Bi Li, Teng Xi, Gang Zhang +5
Perspective-Guided Convolution Networks for Crowd Counting
Zhaoyi Yan, Yuchen Yuan, Wangmeng Zuo +4
StereoDistill: Pick the Cream from LiDAR for Distilling Stereo-based 3D Object Detection
Zhe Liu, Xiaoqing Ye, Xiao Tan +2
CODER: Coupled Diversity-Sensitive Momentum Contrastive Learning for Image-Text Retrieval
Haoran Wang, Dongliang He, Wenhao Wu +7
Skim then Focus: Integrating Contextual and Fine-grained Views for Repetitive Action Counting
Zhengqi Zhao, Xiaohu Huang, Hao Zhou +6
ViSTA: Vision and Scene Text Aggregation for Cross-Modal Retrieval
Mengjun Cheng, Yipeng Sun, Longchao Wang +8
Implicit Sample Extension for Unsupervised Person Re-Identification
Xinyu Zhang, Dongdong Li, Zhigang Wang +5
Image Inpainting with Learnable Bidirectional Attention Maps
Chaohao Xie, Shaohui Liu, Chao Li +5