NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (55)

cs.CV2020

Chinese Street View Text: Large-scale Chinese Text Reading with Partially Supervised Learning

Yipeng Sun, Jiaming Liu, Wei Liu +3

cs.CV2022

UFO: Unified Feature Optimization

Teng Xi, Yifan Sun, Deli Yu +13

cs.LG2026

DreamerAD: Efficient Reinforcement Learning via Latent World Model for Autonomous Driving

Pengxuan Yang, Yupeng Zheng, Deheng Qian +11

cs.CV2022

Cyclically Disentangled Feature Translation for Face Anti-spoofing

Haixiao Yue, Keyao Wang, Guosheng Zhang +4

cs.CV2022

Few-Shot Font Generation by Learning Fine-Grained Local Styles

Licheng Tang, Yiyang Cai, Jiaming Liu +7

cs.CV2023

Accelerating Vision Transformers Based on Heterogeneous Attention Patterns

Deli Yu, Teng Xi, Jianwei Li +7

cs.CV2023

PSVT: End-to-End Multi-person 3D Pose and Shape Estimation with Progressive Video Transformers

Zhongwei Qiu, Yang Qiansheng, Jian Wang +6

cs.CV2023

StrucTexTv2: Masked Visual-Textual Prediction for Document Image Pre-training

Yuechen Yu, Yulin Li, Chengquan Zhang +7

cs.CV2019

ICDAR 2019 Competition on Large-scale Street View Text with Partial Labeling -- RRC-LSVT

Yipeng Sun, Zihan Ni, Chee-Kheng Chng +9

cs.AI2026

FlowR2A: Learning Reward-to-Action Distribution for Multimodal Driving Planning

Xirui Li, Zhe Liu, Xiaoqing Ye +4

cs.CV2023

Semi-DETR: Semi-Supervised Object Detection with Detection Transformers

Jiacheng Zhang, Xiangru Lin, Wei Zhang +6

cs.CV2019

PyramidBox++: High Performance Detector for Finding Tiny Face

Zhihang Li, Xu Tang, Junyu Han +2

cs.CV2024

Decoupled Pseudo-labeling for Semi-Supervised Monocular 3D Object Detection

Jiacheng Zhang, Jiaming Li, Xiangru Lin +6

cs.CV2022

Few-Shot Head Swapping in the Wild

Changyong Shu, Hemao Wu, Hang Zhou +7

cs.CV2019

ICDAR2019 Robust Reading Challenge on Arbitrary-Shaped Text (RRC-ArT)

Chee-Kheng Chng, Yuliang Liu, Yipeng Sun +11

cs.CV2019

Detecting Text in the Wild with Deep Character Embedding Network

Jiaming Liu, Chengquan Zhang, Yipeng Sun +2

cs.CV2017

WordSup: Exploiting Word Annotations for Character based Text Detection

Han Hu, Chengquan Zhang, Yuxuan Luo +3

cs.CV2023

Group DETR: Fast DETR Training with Group-Wise One-to-Many Assignment

Qiang Chen, Xiaokang Chen, Jian Wang +7

cs.CV2023

Group Pose: A Simple Baseline for End-to-End Multi-person Pose Estimation

Huan Liu, Qiang Chen, Zichang Tan +9

cs.CV2023

Graph Contrastive Learning for Skeleton-based Action Recognition

Xiaohu Huang, Hao Zhou, Jian Wang +7

cs.CV2022

CAE v2: Context Autoencoder with CLIP Target

Xinyu Zhang, Jiahui Chen, Junkun Yuan +10

cs.CV2020

Learning Generalized Spoof Cues for Face Anti-spoofing

Haocheng Feng, Zhibin Hong, Haixiao Yue +5

cs.CV2019

ACFNet: Attentional Class Feature Network for Semantic Segmentation

Fan Zhang, Yanqin Chen, Zhihang Li +5

cs.CV2019

An End-to-end Video Text Detector with Online Tracking

Hongyuan Yu, Chengquan Zhang, Xuan Li +3

cs.CV2022

Group DETR v2: Strong Object Detector with Encoder-Decoder Pretraining

Qiang Chen, Jian Wang, Chuchu Han +12

cs.CV2018

TextNet: Irregular Text Reading from Images with an End-to-End Trainable Network

Yipeng Sun, Chengquan Zhang, Zuming Huang +3

cs.CV2023

Ambiguity-Resistant Semi-Supervised Learning for Dense Object Detection

Chang Liu, Weiming Zhang, Xiangru Lin +6

cs.CV2021

Dynamic Class Queue for Large Scale Face Recognition In the Wild

Bi Li, Teng Xi, Gang Zhang +5

cs.CV2025

World knowledge-enhanced Reasoning Using Instruction-guided Interactor in Autonomous Driving

Mingliang Zhai, Cheng Li, Zengyuan Guo +7

cs.CV2022

Singular Value Fine-tuning: Few-shot Segmentation requires Few-parameters Fine-tuning

Yanpeng Sun, Qiang Chen, Xiangyu He +7

cs.CV2024

Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention

Hannan Lu, Xiaohe Wu, Shudong Wang +5

cs.CV2022

ViSTA: Vision and Scene Text Aggregation for Cross-Modal Retrieval

Mengjun Cheng, Yipeng Sun, Longchao Wang +8

cs.CV2019

Editing Text in the Wild

Liang Wu, Chengquan Zhang, Jiaming Liu +4

cs.CV2021

StrucTexT: Structured Text Understanding with Multi-Modal Transformers

Yulin Li, Yuxi Qian, Yuchen Yu +7

cs.CV2024

Gradient-based Sampling for Class Imbalanced Semi-supervised Object Detection

Jiaming Li, Xiangru Lin, Wei Zhang +6

cs.CV2021

PGNet: Real-time Arbitrarily-Shaped Text Spotting with Point Gathering Network

Pengfei Wang, Chengquan Zhang, Fei Qi +7

cs.CV2019

Look More Than Once: An Accurate Detector for Text of Arbitrary Shapes

Chengquan Zhang, Borong Liang, Zuming Huang +4

cs.CV2023

MaskOCR: Text Recognition with Masked Encoder-Decoder Pretraining

Pengyuan Lyu, Chengquan Zhang, Shanshan Liu +7

cs.CV2022

RTFormer: Efficient Design for Real-Time Semantic Segmentation with Transformer

Jian Wang, Chenhui Gou, Qiman Wu +4

cs.CV2020

AIM 2020 Challenge on Real Image Super-Resolution: Methods and Results

Pengxu Wei, Hannan Lu, Radu Timofte +68

cs.CV2020

Learning Global Structure Consistency for Robust Object Tracking

Bi Li, Chengquan Zhang, Zhibin Hong +5

eess.IV2021

Real Image Super Resolution Via Heterogeneous Model Ensemble using GP-NAS

Zhihong Pan, Baopu Li, Teng Xi +5

cs.CV2025

KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling

Yu Wang, Xin Li, Shengzhao Weng +5

cs.CV2020

Towards Accurate Scene Text Recognition with Semantic Reasoning Networks

Deli Yu, Xuan Li, Chengquan Zhang +3

cs.CV2019

EATEN: Entity-aware Attention for Single Shot Visual Text Extraction

He guo, Xiameng Qin, Jiaming Liu +3

cs.CV2021

FaceController: Controllable Attribute Editing for Face in the Wild

Zhiliang Xu, Xiyu Yu, Zhibin Hong +5

cs.CV2019

HAMBox: Delving into Online High-quality Anchors Mining for Detecting Outer Faces

Yang Liu, Xu Tang, Xiang Wu +3

cs.CV2022

MobileFaceSwap: A Lightweight Framework for Video Face Swapping

Zhiliang Xu, Zhibin Hong, Changxing Ding +4

cs.RO2025

TakeAD: Preference-based Post-optimization for End-to-end Autonomous Driving with Expert Takeover Data

Deqing Liu, Yinfeng Gao, Deheng Qian +9

cs.CV2019

A Single-Shot Arbitrarily-Shaped Text Detector based on Context Attended Multi-Task Learning

Pengfei Wang, Chengquan Zhang, Fei Qi +6

cs.CV2020

NTIRE 2020 Challenge on Real Image Denoising: Dataset, Methods and Results

Abdelrahman Abdelhamed, Mahmoud Afifi, Radu Timofte +87

cs.CV2023

Learning Structure-Guided Diffusion Model for 2D Human Pose Estimation

Zhongwei Qiu, Qiansheng Yang, Jian Wang +7

cs.CV2023

MataDoc: Margin and Text Aware Document Dewarping for Arbitrary Boundary

Beiya Dai, Xing li, Qunyi Xie +5

cs.CV2022

StyleSwap: Style-Based Generator Empowers Robust Face Swapping

Zhiliang Xu, Hang Zhou, Zhibin Hong +7

cs.CV2023

HAP: Structure-Aware Masked Image Modeling for Human-Centric Perception

Junkun Yuan, Xinyu Zhang, Hao Zhou +12