NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (156)

cs.CV2022

Cyclically Disentangled Feature Translation for Face Anti-spoofing

Haixiao Yue, Keyao Wang, Guosheng Zhang +4

cs.CV2022

Few-Shot Font Generation by Learning Fine-Grained Local Styles

Licheng Tang, Yiyang Cai, Jiaming Liu +7

cs.CV2024

LaMI-DETR: Open-Vocabulary Detection with Language Model Instruction

Penghui Du, Yu Wang, Yifan Sun +7

cs.CV2021

Image Inpainting by End-to-End Cascaded Refinement with Mask Awareness

Manyu Zhu, Dongliang He, Xin Li +5

cs.CV2024

Decoupled Pseudo-labeling for Semi-Supervised Monocular 3D Object Detection

Jiacheng Zhang, Jiaming Li, Xiangru Lin +6

cs.CV2022

Few-Shot Head Swapping in the Wild

Changyong Shu, Hemao Wu, Hang Zhou +7

cs.CV2022

MixFormer: Mixing Features across Windows and Dimensions

Qiang Chen, Qiman Wu, Jian Wang +5

cs.CV2023

Group Pose: A Simple Baseline for End-to-End Multi-person Pose Estimation

Huan Liu, Qiang Chen, Zichang Tan +9

cs.CV2019

ACFNet: Attentional Class Feature Network for Semantic Segmentation

Fan Zhang, Yanqin Chen, Zhihang Li +5

cs.CV2022

Part-aware Prototypical Graph Network for One-shot Skeleton-based Action Recognition

Tailin Chen, Desen Zhou, Jian Wang +6

cs.CV2023

ICDAR 2023 Competition on Structured Text Extraction from Visually-Rich Document Images

Wenwen Yu, Chengquan Zhang, Haoyu Cao +24

cs.CV2020

Understanding Image Retrieval Re-Ranking: A Graph Neural Network Perspective

Xuanmeng Zhang, Minyue Jiang, Zhedong Zheng +3

cs.CV2021

Dual-stream Network for Visual Recognition

Mingyuan Mao, Renrui Zhang, Honghui Zheng +6

cs.CV2024

Splatter-360: Generalizable 360$^{\circ}$ Gaussian Splatting for Wide-baseline Panoramic Images

Zheng Chen, Chenming Wu, Zhelun Shen +5

cs.CV2023

Building an Invisible Shield for Your Portrait against Deepfakes

Jiazhi Guan, Tianshu Hu, Hang Zhou +5

cs.CV2023

CAPE: Camera View Position Embedding for Multi-View 3D Object Detection

Kaixin Xiong, Shi Gong, Xiaoqing Ye +5

cs.CV2021

StrucTexT: Structured Text Understanding with Multi-Modal Transformers

Yulin Li, Yuxi Qian, Yuchen Yu +7

cs.CV2019

Look More Than Once: An Accurate Detector for Text of Arbitrary Shapes

Chengquan Zhang, Borong Liang, Zuming Huang +4

cs.CV2024

GIR: 3D Gaussian Inverse Rendering for Relightable Scene Factorization

Yahao Shi, Yanmin Wu, Chenming Wu +7

cs.CV2022

Predict, Prevent, and Evaluate: Disentangled Text-Driven Image Manipulation Empowered by Pre-Trained Vision-Language Model

Zipeng Xu, Tianwei Lin, Hao Tang +6

cs.CV2021

ASCNet: Self-supervised Video Representation Learning with Appearance-Speed Consistency

Deng Huang, Wenhao Wu, Weiwen Hu +6

cs.CV2023

Delicate Textured Mesh Recovery from NeRF via Adaptive Surface Refinement

Jiaxiang Tang, Hang Zhou, Xiaokang Chen +4

cs.CV2023

HD-Fusion: Detailed Text-to-3D Generation Leveraging Multiple Noise Estimation

Jinbo Wu, Xiaobo Gao, Xing Liu +5

cs.CV2021

FaceController: Controllable Attribute Editing for Face in the Wild

Zhiliang Xu, Xiyu Yu, Zhibin Hong +5

cs.CV2025

An Information Theory-inspired Strategy for Automatic Network Pruning

Xiawu Zheng, Yuexiao Ma, Teng Xi +6

cs.CV2025

Interpretable Face Anti-Spoofing: Enhancing Generalization with Multimodal Large Language Models

Guosheng Zhang, Keyao Wang, Haixiao Yue +5

cs.CV2020

Segment as Points for Efficient Online Multi-Object Tracking and Segmentation

Zhenbo Xu, Wei Zhang, Xiao Tan +5

cs.CV2024

OpenGaussian: Towards Point-Level 3D Gaussian-based Open Vocabulary Understanding

Yanmin Wu, Jiarui Meng, Haijie Li +8

cs.CV2024

GVA: Reconstructing Vivid 3D Gaussian Avatars from Monocular Videos

Xinqi Liu, Chenming Wu, Jialun Liu +6

cs.CV2019

A Single-Shot Arbitrarily-Shaped Text Detector based on Context Attended Multi-Task Learning

Pengfei Wang, Chengquan Zhang, Fei Qi +6

cs.CV2020

NTIRE 2020 Challenge on Real Image Denoising: Dataset, Methods and Results

Abdelrahman Abdelhamed, Mahmoud Afifi, Radu Timofte +87

cs.CV2022

AGO-Net: Association-Guided 3D Point Cloud Object Detection Network

Liang Du, Xiaoqing Ye, Xiao Tan +5

cs.CV2022

Rope3D: TheRoadside Perception Dataset for Autonomous Driving and Monocular 3D Object Detection Task

Xiaoqing Ye, Mao Shu, Hanyu Li +5

cs.CV2022

StyleSwap: Style-Based Generator Empowers Robust Face Swapping

Zhiliang Xu, Hang Zhou, Zhibin Hong +7

cs.CV2022

Delving into Sequential Patches for Deepfake Detection

Jiazhi Guan, Hang Zhou, Zhibin Hong +4

cs.CV2022

Boosting Video-Text Retrieval with Explicit High-Level Semantics

Haoran Wang, Di Xu, Dongliang He +4

cs.CV2021

PAFNet: An Efficient Anchor-Free Object Detector Guidance

Ying Xin, Guanzhong Wang, Mingyuan Mao +5

cs.CV2025

Re-HOLD: Video Hand Object Interaction Reenactment via adaptive Layout-instructed Diffusion Model

Yingying Fan, Quanwei Yang, Kaisiyuan Wang +6

cs.CV2022

UFO: Unified Feature Optimization

Teng Xi, Yifan Sun, Deli Yu +13

cs.CV2021

Unsupervised Multi-Source Domain Adaptation for Person Re-Identification

Zechen Bai, Zhigang Wang, Jian Wang +2

cs.CV2025

AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers

Jiazhi Guan, Kaisiyuan Wang, Zhiliang Xu +12

cs.CV2020

PointTrack++ for Effective Online Multi-Object Tracking and Segmentation

Zhenbo Xu, Wei Zhang, Xiao Tan +7

cs.CV2023

Accelerating Vision Transformers Based on Heterogeneous Attention Patterns

Deli Yu, Teng Xi, Jianwei Li +7

cs.CV2019

ICDAR 2019 Competition on Large-scale Street View Text with Partial Labeling -- RRC-LSVT

Yipeng Sun, Zihan Ni, Chee-Kheng Chng +9

cs.CV2024

TexRO: Generating Delicate Textures of 3D Models by Recursive Optimization

Jinbo Wu, Xing Liu, Chenming Wu +7

cs.CV2024

OVLW-DETR: Open-Vocabulary Light-Weighted Detection Transformer

Yu Wang, Xiangbo Su, Qiang Chen +6

cs.CV2019

ICDAR2019 Robust Reading Challenge on Arbitrary-Shaped Text (RRC-ArT)

Chee-Kheng Chng, Yuliang Liu, Yipeng Sun +11

cs.CV2024

OPEN: Object-wise Position Embedding for Multi-view 3D Object Detection

Jinghua Hou, Tong Wang, Xiaoqing Ye +6

cs.CV2019

Dynamic Instance Normalization for Arbitrary Style Transfer

Yongcheng Jing, Xiao Liu, Yukang Ding +4

cs.CV2017

WordSup: Exploiting Word Annotations for Character based Text Detection

Han Hu, Chengquan Zhang, Yuxuan Luo +3

cs.CV2023

Group DETR: Fast DETR Training with Group-Wise One-to-Many Assignment

Qiang Chen, Xiaokang Chen, Jian Wang +7

cs.CV2021

Student-Teacher Feature Pyramid Matching for Anomaly Detection

Guodong Wang, Shumin Han, Errui Ding +1

cs.CV2021

Beyond Self-Supervision: A Simple Yet Effective Network Distillation Alternative to Improve Backbones

Cheng Cui, Ruoyu Guo, Yuning Du +10

cs.CV2019

An End-to-end Video Text Detector with Online Tracking

Hongyuan Yu, Chengquan Zhang, Xuan Li +3

cs.CV2018

Multi-Attention Multi-Class Constraint for Fine-grained Image Recognition

Ming Sun, Yuchen Yuan, Feng Zhou +1

cs.CV2020

PP-YOLO: An Effective and Efficient Implementation of Object Detector

Xiang Long, Kaipeng Deng, Guanzhong Wang +8

cs.CV2022

Singular Value Fine-tuning: Few-shot Segmentation requires Few-parameters Fine-tuning

Yanpeng Sun, Qiang Chen, Xiangyu He +7

cs.CV2019

Editing Text in the Wild

Liang Wu, Chengquan Zhang, Jiaming Liu +4

cs.CV2021

Drafting and Revision: Laplacian Pyramid Network for Fast High-Quality Artistic Style Transfer

Tianwei Lin, Zhuoqi Ma, Fu Li +6

cs.CV2025

TexGaussian: Generating High-quality PBR Material via Octree-based 3D Gaussian Splatting

Bojun Xiong, Jialun Liu, Jiakui Hu +6

cs.CV2022

Neural Color Operators for Sequential Image Retouching

Yili Wang, Xin Li, Kun Xu +4

cs.CV2022

RTFormer: Efficient Design for Real-Time Semantic Segmentation with Transformer

Jian Wang, Chenhui Gou, Qiman Wu +4

cs.CV2025

Explanatory Instructions: Towards Unified Vision Tasks Understanding and Zero-shot Generalization

Yang Shen, Xiu-Shen Wei, Yifan Sun +6

cs.CV2021

Learning Multi-Granular Spatio-Temporal Graph Network for Skeleton-based Action Recognition

Tailin Chen, Desen Zhou, Jian Wang +4

eess.IV2021

Real Image Super Resolution Via Heterogeneous Model Ensemble using GP-NAS

Zhihong Pan, Baopu Li, Teng Xi +5

cs.CV2020

Coherent Loss: A Generic Framework for Stable Video Segmentation

Mingyang Qian, Yi Fu, Xiao Tan +5

cs.CV2025

KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling

Yu Wang, Xin Li, Shengzhao Weng +5

cs.CV2024

Uni$^2$Det: Unified and Universal Framework for Prompt-Guided Multi-dataset 3D Detection

Yubin Wang, Zhikang Zou, Xiaoqing Ye +3

cs.CV2019

HAMBox: Delving into Online High-quality Anchors Mining for Detecting Outer Faces

Yang Liu, Xu Tang, Xiang Wu +3

cs.CV2022

Action Quality Assessment with Temporal Parsing Transformer

Yang Bai, Desen Zhou, Songyang Zhang +5

cs.CV2020

Discriminative Sounding Objects Localization via Self-supervised Audiovisual Matching

Di Hu, Rui Qian, Minyue Jiang +5

cs.CV2023

LMR: A Large-Scale Multi-Reference Dataset for Reference-based Super-Resolution

Lin Zhang, Xin Li, Dongliang He +2

cs.CV2022

U-HRNet: Delving into Improving Semantic Representation of High Resolution Network for Dense Prediction

Jian Wang, Xiang Long, Guowei Chen +3

cs.CV2018

Fine-grained Video Categorization with Redundancy Reduction Attention

Chen Zhu, Xiao Tan, Feng Zhou +4

cs.CV2022

Masked Lip-Sync Prediction by Audio-Visual Contextual Exploitation in Transformers

Yasheng Sun, Hang Zhou, Kaisiyuan Wang +7

cs.CV2022

Adversarial Dual-Student with Differentiable Spatial Warping for Semi-Supervised Semantic Segmentation

Cong Cao, Tianwei Lin, Dongliang He +4

cs.CV2020

Chinese Street View Text: Large-scale Chinese Text Reading with Partially Supervised Learning

Yipeng Sun, Jiaming Liu, Wei Liu +3

cs.CV2016

Localizing by Describing: Attribute-Guided Attention Localization for Fine-Grained Recognition

Xiao Liu, Jiang Wang, Shilei Wen +2

cs.CV2022

Paint and Distill: Boosting 3D Object Detection with Semantic Passing Network

Bo Ju, Zhikang Zou, Xiaoqing Ye +4

cs.CV2019

STGAN: A Unified Selective Transfer Network for Arbitrary Image Attribute Editing

Ming Liu, Yukang Ding, Min Xia +4

cs.CV2023

StrucTexTv2: Masked Visual-Textual Prediction for Document Image Pre-training

Yuechen Yu, Yulin Li, Chengquan Zhang +7

cs.CV2024

TALK-Act: Enhance Textural-Awareness for 2D Speaking Avatar Reenactment with Diffusion Model

Jiazhi Guan, Quanwei Yang, Kaisiyuan Wang +9

cs.CV2023

VideoGen: A Reference-Guided Latent Diffusion Approach for High Definition Text-to-Video Generation

Xin Li, Wenqing Chu, Ye Wu +7

cs.CV2022

GitNet: Geometric Prior-based Transformation for Birds-Eye-View Segmentation

Shi Gong, Xiaoqing Ye, Xiao Tan +4

cs.CV2023

Semi-DETR: Semi-Supervised Object Detection with Detection Transformers

Jiacheng Zhang, Xiangru Lin, Wei Zhang +6

cs.CV2024

ALoRE: Efficient Visual Adaptation via Aggregating Low Rank Experts

Sinan Du, Guosheng Zhang, Keyao Wang +7

cs.CV2023

Graph Contrastive Learning for Skeleton-based Action Recognition

Xiaohu Huang, Hao Zhou, Jian Wang +7

cs.CV2022

CAE v2: Context Autoencoder with CLIP Target

Xinyu Zhang, Jiahui Chen, Junkun Yuan +10

cs.CV2020

Learning Generalized Spoof Cues for Face Anti-spoofing

Haocheng Feng, Zhibin Hong, Haixiao Yue +5

cs.CV2022

Group DETR v2: Strong Object Detector with Encoder-Decoder Pretraining

Qiang Chen, Jian Wang, Chuchu Han +12

cs.CV2019

BMN: Boundary-Matching Network for Temporal Action Proposal Generation

Tianwei Lin, Xiao Liu, Xin Li +2

cs.CV2025

VRP-SAM: SAM with Visual Reference Prompt

Yanpeng Sun, Jiahui Chen, Shan Zhang +7

cs.CV2021

Dynamic Class Queue for Large Scale Face Recognition In the Wild

Bi Li, Teng Xi, Gang Zhang +5

cs.CV2019

Perspective-Guided Convolution Networks for Crowd Counting

Zhaoyi Yan, Yuchen Yuan, Wangmeng Zuo +4

cs.CV2023

StereoDistill: Pick the Cream from LiDAR for Distilling Stereo-based 3D Object Detection

Zhe Liu, Xiaoqing Ye, Xiao Tan +2

cs.CV2026

CODER: Coupled Diversity-Sensitive Momentum Contrastive Learning for Image-Text Retrieval

Haoran Wang, Dongliang He, Wenhao Wu +7

cs.CV2024

Skim then Focus: Integrating Contextual and Fine-grained Views for Repetitive Action Counting

Zhengqi Zhao, Xiaohu Huang, Hao Zhou +6

cs.CV2022

ViSTA: Vision and Scene Text Aggregation for Cross-Modal Retrieval

Mengjun Cheng, Yipeng Sun, Longchao Wang +8

cs.CV2022

Implicit Sample Extension for Unsupervised Person Re-Identification

Xinyu Zhang, Dongdong Li, Zhigang Wang +5

cs.CV2019

Image Inpainting with Learnable Bidirectional Attention Maps

Chaohao Xie, Shaohui Liu, Chao Li +5