NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (188)

cs.CV2024

{S$^3$-Mamba}: Small-Size-Sensitive Mamba for Lesion Segmentation

Gui Wang, Yuexiang Li, Wenting Chen +5

cs.CV2021

FS-Net: Fast Shape-based Network for Category-Level 6D Object Pose Estimation with Decoupled Rotation Mechanism

Wei Chen, Xi Jia, Hyung Jin Chang +3

cs.CV2024

From Pretext to Purpose: Batch-Adaptive Self-Supervised Learning

Jiansong Zhang, Linlin Shen, Peizhong Liu

cs.CV2025

FineMotion: A Dataset and Benchmark with both Spatial and Temporal Annotation for Fine-grained Motion Generation and Editing

Bizhu Wu, Jinheng Xie, Meidan Ding +5

cs.CV2025

UINO-FSS: Unifying Representation Learning and Few-shot Segmentation via Hierarchical Distillation and Mamba-HyperCorrelation

Wei Zhuo, Zhiyue Tang, Wufeng Xue +3

cs.CV2023

MRecGen: Multimodal Appropriate Reaction Generator

Jiaqi Xu, Cheng Luo, Weicheng Xie +5

cs.CV2022

Delving into the Scale Variance Problem in Object Detection

Junliang Chen, Xiaodong Zhao, Linlin Shen

cs.CV2024

Multi-scale Dynamic and Hierarchical Relationship Modeling for Facial Action Units Recognition

Zihan Wang, Siyang Song, Cheng Luo +3

cs.CV2016

Object Specific Deep Learning Feature and Its Application to Face Detection

Xianxu Hou, Ke Sun, Linlin Shen +1

cs.CV2026

Adaptive Texture-aware Masking for Self-Supervised Learning in 3D Dental CBCT Analysis

Xinquan Yang, Jianfeng Ren, Xuguang Li +4

cs.CV2026

REAL-OW: Rehearsal-free Open World Object Detection with Low-Rank Adaptation and Dual-Stage Objectness Modeling

Huazhong Zhang, Xiaowen Fu, Yang Zhang +2

cs.CV2025

Mitigating Group-Level Fairness Disparities in Federated Visual Language Models

Chaomeng Chen, Zitong Yu, Junhao Dong +4

cs.CV2025

Context-Gated Cross-Modal Perception with Visual Mamba for PET-CT Lung Tumor Segmentation

Elena Mulero Ayllón, Linlin Shen, Pierangelo Veltri +4

cs.CV2026

FairForensics: Seeing Expressions and Parsing Demographics via Vision-Language Modeling for Generalizable Fair Deepfake Detection

Yaning Zhang, Jiao Wu, Zan Gao +1

cs.CV2021

MixSearch: Searching for Domain Generalized Medical Image Segmentation Architectures

Luyan Liu, Zhiwei Wen, Songwei Liu +6

cs.CV2024

HairDiffusion: Vivid Multi-Colored Hair Editing via Latent Diffusion

Yu Zeng, Yang Zhang, Jiachen Liu +4

cs.CV2016

Output Constraint Transfer for Kernelized Correlation Filter in Tracking

Baochang Zhang, Zhigang Li, Xianbin Cao +5

cs.CV2025

OralGPT-Omni: A Versatile Dental Multimodal Large Language Model

Jing Hao, Yuci Liang, Lizhuo Lin +12

cs.LG2024

Activation Space Selectable Kolmogorov-Arnold Networks

Zhuoqin Yang, Jiansong Zhang, Xiaoling Luo +2

cs.CY2026

A Survey of Large Language Models for Perception and Measurement of Human Psychology

Yudong Li, Xiaoyi Chen, Jiawei Cai +4

cs.CV2026

ImplantMamba: Long-range Sequential Modeling Mamba For Dental Implant Position Prediction

Xinquan Yang, Congmin Wang, Xuguang Li +3

cs.CV2025

Any-to-Any Vision-Language Model for Multimodal X-ray Imaging and Radiological Report Generation

Daniele Molino, Francesco di Feola, Linlin Shen +2

cs.CV2024

GM-DF: Generalized Multi-Scenario Deepfake Detection

Yingxin Lai, Zitong Yu, Jing Yang +3

cs.CV2026

ReactMotion: Generating Reactive Listener Motions from Speaker Utterance

Cheng Luo, Bizhu Wu, Bing Li +5

cs.LG2025

Enhancing Adversarial Transferability by Balancing Exploration and Exploitation with Gradient-Guided Sampling

Zenghao Niu, Weicheng Xie, Siyang Song +3

eess.IV2020

MI^2GAN: Generative Adversarial Network for Medical Image Domain Adaptation using Mutual Information Constraint

Xinpeng Xie, Jiawei Chen, Yuexiang Li +3

cs.CV2025

SPF-Portrait: Towards Pure Text-to-Portrait Customization with Semantic Pollution-Free Fine-Tuning

Xiaole Xian, Zhichao Liao, Qingyu Li +6

cs.CV2022

Robust Representation via Dynamic Feature Aggregation

Haozhe Liu, Haoqin Ji, Yuexiang Li +5

cs.CV2026

MMedExpert-R1: Strengthening Multimodal Medical Reasoning via Domain-Specific Adaptation and Clinical Guideline Reinforcement

Meidan Ding, Jipeng Zhang, Wenxuan Wang +4

cs.CV2024

High-Performance Fine Defect Detection in Artificial Leather Using Dual Feature Pool Object Detection

Lin Huang, Weisheng Li, Yujuan Tan +2

cs.CV2025

Oral Imaging for Malocclusion Issues Assessments: OMNI Dataset, Deep Learning Baselines and Benchmarking

Pujun Xue, Junyi Ge, Xiaotong Jiang +8

cs.CV2023

Taming Self-Supervised Learning for Presentation Attack Detection: De-Folding and De-Mixing

Zhe Kong, Wentian Zhang, Feng Liu +4

cs.CL2023

TencentPretrain: A Scalable and Flexible Toolkit for Pre-training Models of Different Modalities

Zhe Zhao, Yudong Li, Cheng Hou +23

cs.CV2022

Cross Language Image Matching for Weakly Supervised Semantic Segmentation

Jinheng Xie, Xianxu Hou, Kai Ye +1

cs.LG2018

A Self-Organizing Tensor Architecture for Multi-View Clustering

Lifang He, Chun-ta Lu, Yong Chen +4

eess.IV2024

Multi-Dataset Multi-Task Learning for COVID-19 Prognosis

Filippo Ruffini, Lorenzo Tronchin, Zhuoru Wu +4

cs.CV2020

GuidedStyle: Attribute Knowledge Guided Style Manipulation for Semantic Face Editing

Xianxu Hou, Xiaokang Zhang, Linlin Shen +2

cs.CV2025

HySurvPred: Multimodal Hyperbolic Embedding with Angle-Aware Hierarchical Contrastive Learning and Uncertainty Constraints for Survival Prediction

Jiaqi Yang, Wenting Chen, Xiaohan Xing +5

cs.CV2024

WiNet: Wavelet-based Incremental Learning for Efficient Medical Image Registration

Xinxing Cheng, Xi Jia, Wenqi Lu +4

cs.CV2023

Category-Level 6D Object Pose Estimation with Flexible Vector-Based Rotation Representation

Wei Chen, Xi Jia, Zhongqun Zhang +4

cs.CV2025

Text Condition Embedded Regression Network for Automated Dental Abutment Design

Mianjie Zheng, Xinquan Yang, Xuguang Li +5

cs.CV2021

Manifold-preserved GANs

Haozhe Liu, Hanbang Liang, Xianxu Hou +3

cs.CV2024

CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute Editing

Xiaole Xian, Xilin He, Zenghao Niu +5

cs.CV2019

Inferring Dynamic Representations of Facial Actions from a Still Image

Siyang Song, Enrique Sánchez-Lozano, Linlin Shen +2

cs.CV2024

Deep Feature Consistent Variational Autoencoder

Xianxu Hou, Linlin Shen, Ke Sun +1

cs.CV2025

MedKAN: An Advanced Kolmogorov-Arnold Network for Medical Image Classification

Zhuoqin Yang, Jiansong Zhang, Xiaoling Luo +2

cs.CV2022

Selective Multi-Scale Learning for Object Detection

Junliang Chen, Weizeng Lu, Linlin Shen

cs.CV2020

Wavelet Integrated CNNs for Noise-Robust Image Classification

Qiufu Li, Linlin Shen, Sheng Guo +1

eess.IV2024

QUBIQ: Uncertainty Quantification for Biomedical Image Segmentation Challenge

Hongwei Bran Li, Fernando Navarro, Ivan Ezhov +77

cs.CV2025

EyePCR: A Comprehensive Benchmark for Fine-Grained Perception, Knowledge Comprehension and Clinical Reasoning in Ophthalmic Surgery

Gui Wang, Yang Wennuo, Xusen Ma +7

cs.CV2022

Contrastive learning of Class-agnostic Activation Map for Weakly Supervised Object Localization and Semantic Segmentation

Jinheng Xie, Jianfeng Xiang, Junliang Chen +3

cs.CV2026

Vision KAN: Towards an Attention-Free Backbone for Vision with Kolmogorov-Arnold Networks

Zhuoqin Yang, Jiansong Zhang, Xiaoling Luo +3

eess.IV2020

Context Aware 3D UNet for Brain Tumor Segmentation

Parvez Ahmad, Saqib Qamar, Linlin Shen +1

cs.CV2022

A Benchmark for Weakly Semi-Supervised Abnormality Localization in Chest X-Rays

Haoqin Ji, Haozhe Liu, Yuexiang Li +7

cs.CV2025

D^3-Talker: Dual-Branch Decoupled Deformation Fields for Few-Shot 3D Talking Head Synthesis

Yuhang Guo, Kaijun Deng, Siyang Song +3

cs.CV2024

YOLOCS: Object Detection based on Dense Channel Compression for Feature Spatial Solidification

Lin Huang, Weisheng Li, Yujuan Tan +3

cs.CL2025

Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models

Meidan Ding, Jipeng Zhang, Wenxuan Wang +6

cs.CV2024

Distilled Transformers with Locally Enhanced Global Representations for Face Forgery Detection

Yaning Zhang, Qiufu Li, Zitong Yu +1

cs.LG2025

Benchmarking Graph Representations and Graph Neural Networks for Multivariate Time Series Classification

Wennuo Yang, Shiling Wu, Yuzhi Zhou +5

cs.CV2025

Benchmarking Foundation Models and Parameter-Efficient Fine-Tuning for Prognosis Prediction in Medical Imaging

Filippo Ruffini, Elena Mulero Ayllon, Linlin Shen +2

cs.CV2025

LabelGS: Label-Aware 3D Gaussian Splatting for 3D Scene Segmentation

Yupeng Zhang, Dezhi Zheng, Ping Lu +8

cs.CV2024

ReactFace: Online Multiple Appropriate Facial Reaction Generation in Dyadic Interactions

Cheng Luo, Siyang Song, Weicheng Xie +4

cs.CV2020

Translate the Facial Regions You Like Using Region-Wise Normalization

Wenshuang Liu, Wenting Chen, Linlin Shen

cs.CV2026

X-ray Insights Unleashed: Pioneering the Enhancement of Multi-Label Long-Tail Data

Xinquan Yang, Jinheng Xie, Yawen Huang +6

cs.CL2022

CSL: A Large-scale Chinese Scientific Literature Dataset

Yudong Li, Yuqing Zhang, Zhe Zhao +4

cs.SD2018

Noise Invariant Frame Selection: A Simple Method to Address the Background Noise Problem for Text-independent Speaker Verification

Siyang Song, Shuimei Zhang, Björn Schuller +2

cs.CV2019

Improving Variational Autoencoder with Deep Feature Consistent and Generative Adversarial Training

Xianxu Hou, Ke Sun, Linlin Shen +1

cs.CV2026

ForensicZip: More Tokens are Better but Not Necessary in Forensic Vision-Language Models

Yingxin Lai, Zitong Yu, Jun Wang +3

cs.CV2024

SSAD: Self-supervised Auxiliary Detection Framework for Panoramic X-ray based Dental Disease Diagnosis

Zijian Cai, Xinquan Yang, Xuguang Li +5

eess.IV2021

Learning from Pseudo Lesion: A Self-supervised Framework for COVID-19 Diagnosis

Zhongliang Li, Zhihao Jin, Xuechen Li +1

cs.CV2024

GEM: Context-Aware Gaze EstiMation with Visual Search Behavior Matching for Chest Radiograph

Shaonan Liu, Wenting Chen, Jie Liu +2

cs.CV2026

Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models

Shaonan Liu, Guo Yu, Xiaoling Luo +4

cs.CV2026

GazeCLIP: Gaze-Guided CLIP with Adaptive-Enhanced Fine-Grained Language Prompt for Deepfake Attribution and Detection

Yaning Zhang, Linlin Shen, Zitong Yu +2

cs.CV2024

Simplify Implant Depth Prediction as Video Grounding: A Texture Perceive Implant Depth Prediction Network

Xinquan Yang, Xuguang Li, Xiaoling Luo +4

cs.CV2021

Online Refinement of Low-level Feature Based Activation Map for Weakly Supervised Object Localization

Jinheng Xie, Cheng Luo, Xiangping Zhu +3

cs.CV2025

DisFaceRep: Representation Disentanglement for Co-occurring Facial Components in Weakly Supervised Face Parsing

Xiaoqin Wang, Xianxu Hou, Meidan Ding +4

cs.CL2025

Medical Reasoning in the Era of LLMs: A Systematic Review of Enhancement Techniques and Applications

Wenxuan Wang, Zizhan Ma, Meidan Ding +8

cs.CV2024

Low-Light Enhancement Effect on Classification and Detection: An Empirical Study

Xu Wu, Zhihui Lai, Zhou Jie +4

cs.CV2024

Boosting Adversarial Transferability across Model Genus by Deformation-Constrained Warping

Qinliang Lin, Cheng Luo, Zenghao Niu +5

cs.CV2020

WaveSNet: Wavelet Integrated Deep Networks for Image Segmentation

Qiufu Li, Linlin Shen

cs.CV2025

SSA3D: Text-Conditioned Assisted Self-Supervised Framework for Automatic Dental Abutment Design

Mianjie Zheng, Xinquan Yang, Along He +6

cs.CV2023

Open-World Weakly-Supervised Object Localization

Jinheng Xie, Zhaochuan Luo, Yuexiang Li +3

cs.CV2021

Learning Graph Representation of Person-specific Cognitive Processes from Audio-visual Behaviours for Automatic Personality Recognition

Siyang Song, Zilong Shao, Shashank Jaiswal +3

cs.CV2024

DAMPER: A Dual-Stage Medical Report Generation Framework with Coarse-Grained MeSH Alignment and Fine-Grained Hypergraph Matching

Xiaofei Huang, Wenting Chen, Jie Liu +3

cs.AI2026

DIRCR: Dual-Inference Rule-Contrastive Reasoning for Solving RAVENs

Jiachen Zhang, Chengtai Li, Jianfeng Ren +3

cs.LG2026

Maximizing Incremental Information Entropy for Contrastive Learning

Jiansong Zhang, Zhuoqin Yang, Xu Wu +3

cs.CV2025

Taming Anomalies with Down-Up Sampling Networks: Group Center Preserving Reconstruction for 3D Anomaly Detection

Hanzhe Liang, Jie Zhang, Tao Dai +3

cs.CV2018

Active Learning for Breast Cancer Identification

Xinpeng Xie, Yuexiang Li, Linlin Shen

cs.CL2024

A Spectrum Evaluation Benchmark for Medical Multi-Modal Large Language Models

Jie Liu, Wenxuan Wang, Yihang Su +8

cs.CV2026

DinoDental: Benchmarking DINOv3 as a Unified Vision Encoder for Dental Image Analysis

Kun Tang, Xinquan Yang, Mianjie Zheng +6

cs.CV2021

Learning a Model-Driven Variational Network for Deformable Image Registration

Xi Jia, Alexander Thorley, Wei Chen +9

cs.LG2024

Towards Combating Frequency Simplicity-biased Learning for Domain Generalization

Xilin He, Jingyu Hu, Qinliang Lin +5

cs.CV2026

More than the Sum: Panorama-Language Models for Adverse Omni-Scenes

Weijia Fan, Ruiping Liu, Jiale Wei +7

q-bio.TO2025

Mammo-Clustering: Context Clustering based Multi-view Tri Level Information Fusion for Lesion Location and Classification in Mammography

Shilong Yang, Chulong Zhang, Xiaokun Liang +9

cs.CV2024

Question-Answer Cross Language Image Matching for Weakly Supervised Semantic Segmentation

Songhe Deng, Wei Zhuo, Jinheng Xie +1

cs.CV2024

Fine-Grained Image-Text Alignment in Medical Imaging Enables Explainable Cyclic Image-Report Generation

Wenting Chen, Linlin Shen, Jingyang Lin +3

cs.CV2024

TAVP: Task-Adaptive Visual Prompt for Cross-domain Few-shot Segmentation

Jiaqi Yang, Yaning Zhang, Jingxi Hu +3

cs.CV2020

Geometry Constrained Weakly Supervised Object Localization

Weizeng Lu, Xi Jia, Weicheng Xie +3

cs.CV2025

Bringing RGB and IR Together: Hierarchical Multi-Modal Enhancement for Robust Transmission Line Detection

Shengdong Zhang, Xiaoqin Zhang, Wenqi Ren +4

cs.LG2020

Imbalanced Data Learning by Minority Class Augmentation using Capsule Adversarial Networks

Pourya Shamsolmoali, Masoumeh Zareapoor, Linlin Shen +2