papers
Publications (19)
cs.CR2022
ADASYN-Random Forest Based Intrusion Detection Model
Zhewei Chen, Wenwen Yu, Linyue Zhou
cs.CV2024
ClickTrack: Towards Real-time Interactive Single Object Tracking
Kuiran Wang, Xuehui Yu, Wenwen Yu +5
cs.CV2026
GeoFocus: Blending Efficient Global-to-Local Perception for Multimodal Geometry Problem-Solving
Linger Deng, Yuliang Liu, Wenwen Yu +4
cs.CV2020
PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks
Wenwen Yu, Ning Lu, Xianbiao Qi +2
cs.CV2021
MASTER: Multi-Aspect Non-local Network for Scene Text Recognition
Ning Lu, Wenwen Yu, Xianbiao Qi +4
cs.CV2021
Unsupervised Domain Adaptation Network with Category-Centric Prototype Aligner for Biomedical Image Segmentation
Ping Gong, Wenwen Yu, Qiuwen Sun +2
cs.CV2023
Turning a CLIP Model into a Scene Text Spotter
Wenwen Yu, Yuliang Liu, Xingkui Zhu +3
cs.CV2024
P2RBox: Point Prompt Oriented Object Detection with SAM
Guangming Cao, Xuehui Yu, Wenwen Yu +5
cs.CV2024
P2Seg: Pointly-supervised Segmentation via Mutual Distillation
Zipeng Wang, Xuehui Yu, Xumeng Han +4
cs.CV2023
ICDAR 2023 Competition on Structured Text Extraction from Visually-Rich Document Images
Wenwen Yu, Chengquan Zhang, Haoyu Cao +24
cs.CV2023
ICDAR 2023 Competition on Reading the Seal Title
Wenwen Yu, Mingyu Liu, Mingrui Chen +5
cs.CV2024
OCRBench: On the Hidden Mystery of OCR in Large Multimodal Models
Yuliang Liu, Zhang Li, Mingxin Huang +7
cs.CV2023
Turning a CLIP Model into a Scene Text Detector
Wenwen Yu, Yuliang Liu, Wei Hua +3
cs.CV2026
OmniParser V2: Structured-Points-of-Thought for Unified Visual Text Parsing and Its Generality to Multimodal Large Language Models
Wenwen Yu, Zhibo Yang, Jianqiang Wan +5
cs.RO2025
LLMs-guided adaptive compensator: Bringing Adaptivity to Automatic Control Systems with Large Language Models
Zhongchao Zhou, Yuxi Lu, Yaonan Zhu +5
cs.CV2023
Looking and Listening: Audio Guided Text Recognition
Wenwen Yu, Mingyu Liu, Biao Yang +5
cs.CV2025
DocThinker: Explainable Multimodal Large Language Models with Rule-based Reinforcement Learning for Document Understanding
Wenwen Yu, Zhibo Yang, Yuliang Liu +1
q-bio.NC2025
Convergent and divergent connectivity patterns of the arcuate fasciculus in macaques and humans
Jiahao Huang, Ruifeng Li, Wenwen Yu +15
cs.CV2024
OmniParser: A Unified Framework for Text Spotting, Key Information Extraction and Table Recognition
Jianqiang Wan, Sibo Song, Wenwen Yu +6