NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (19)

cs.CR2022

ADASYN-Random Forest Based Intrusion Detection Model

Zhewei Chen, Wenwen Yu, Linyue Zhou

cs.CV2024

ClickTrack: Towards Real-time Interactive Single Object Tracking

Kuiran Wang, Xuehui Yu, Wenwen Yu +5

cs.CV2026

GeoFocus: Blending Efficient Global-to-Local Perception for Multimodal Geometry Problem-Solving

Linger Deng, Yuliang Liu, Wenwen Yu +4

cs.CV2020

PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks

Wenwen Yu, Ning Lu, Xianbiao Qi +2

cs.CV2021

MASTER: Multi-Aspect Non-local Network for Scene Text Recognition

Ning Lu, Wenwen Yu, Xianbiao Qi +4

cs.CV2021

Unsupervised Domain Adaptation Network with Category-Centric Prototype Aligner for Biomedical Image Segmentation

Ping Gong, Wenwen Yu, Qiuwen Sun +2

cs.CV2023

Turning a CLIP Model into a Scene Text Spotter

Wenwen Yu, Yuliang Liu, Xingkui Zhu +3

cs.CV2024

P2RBox: Point Prompt Oriented Object Detection with SAM

Guangming Cao, Xuehui Yu, Wenwen Yu +5

cs.CV2024

P2Seg: Pointly-supervised Segmentation via Mutual Distillation

Zipeng Wang, Xuehui Yu, Xumeng Han +4

cs.CV2023

ICDAR 2023 Competition on Structured Text Extraction from Visually-Rich Document Images

Wenwen Yu, Chengquan Zhang, Haoyu Cao +24

cs.CV2023

ICDAR 2023 Competition on Reading the Seal Title

Wenwen Yu, Mingyu Liu, Mingrui Chen +5

cs.CV2024

OCRBench: On the Hidden Mystery of OCR in Large Multimodal Models

Yuliang Liu, Zhang Li, Mingxin Huang +7

cs.CV2023

Turning a CLIP Model into a Scene Text Detector

Wenwen Yu, Yuliang Liu, Wei Hua +3

cs.CV2026

OmniParser V2: Structured-Points-of-Thought for Unified Visual Text Parsing and Its Generality to Multimodal Large Language Models

Wenwen Yu, Zhibo Yang, Jianqiang Wan +5

cs.RO2025

LLMs-guided adaptive compensator: Bringing Adaptivity to Automatic Control Systems with Large Language Models

Zhongchao Zhou, Yuxi Lu, Yaonan Zhu +5

cs.CV2023

Looking and Listening: Audio Guided Text Recognition

Wenwen Yu, Mingyu Liu, Biao Yang +5

cs.CV2025

DocThinker: Explainable Multimodal Large Language Models with Rule-based Reinforcement Learning for Document Understanding

Wenwen Yu, Zhibo Yang, Yuliang Liu +1

q-bio.NC2025

Convergent and divergent connectivity patterns of the arcuate fasciculus in macaques and humans

Jiahao Huang, Ruifeng Li, Wenwen Yu +15

cs.CV2024

OmniParser: A Unified Framework for Text Spotting, Key Information Extraction and Table Recognition

Jianqiang Wan, Sibo Song, Wenwen Yu +6