Publications (188)
{S$^3$-Mamba}: Small-Size-Sensitive Mamba for Lesion Segmentation
Gui Wang, Yuexiang Li, Wenting Chen +5
FS-Net: Fast Shape-based Network for Category-Level 6D Object Pose Estimation with Decoupled Rotation Mechanism
Wei Chen, Xi Jia, Hyung Jin Chang +3
From Pretext to Purpose: Batch-Adaptive Self-Supervised Learning
Jiansong Zhang, Linlin Shen, Peizhong Liu
FineMotion: A Dataset and Benchmark with both Spatial and Temporal Annotation for Fine-grained Motion Generation and Editing
Bizhu Wu, Jinheng Xie, Meidan Ding +5
UINO-FSS: Unifying Representation Learning and Few-shot Segmentation via Hierarchical Distillation and Mamba-HyperCorrelation
Wei Zhuo, Zhiyue Tang, Wufeng Xue +3
MRecGen: Multimodal Appropriate Reaction Generator
Jiaqi Xu, Cheng Luo, Weicheng Xie +5
Delving into the Scale Variance Problem in Object Detection
Junliang Chen, Xiaodong Zhao, Linlin Shen
Multi-scale Dynamic and Hierarchical Relationship Modeling for Facial Action Units Recognition
Zihan Wang, Siyang Song, Cheng Luo +3
Object Specific Deep Learning Feature and Its Application to Face Detection
Xianxu Hou, Ke Sun, Linlin Shen +1
Adaptive Texture-aware Masking for Self-Supervised Learning in 3D Dental CBCT Analysis
Xinquan Yang, Jianfeng Ren, Xuguang Li +4
REAL-OW: Rehearsal-free Open World Object Detection with Low-Rank Adaptation and Dual-Stage Objectness Modeling
Huazhong Zhang, Xiaowen Fu, Yang Zhang +2
Mitigating Group-Level Fairness Disparities in Federated Visual Language Models
Chaomeng Chen, Zitong Yu, Junhao Dong +4
Context-Gated Cross-Modal Perception with Visual Mamba for PET-CT Lung Tumor Segmentation
Elena Mulero Ayllón, Linlin Shen, Pierangelo Veltri +4
FairForensics: Seeing Expressions and Parsing Demographics via Vision-Language Modeling for Generalizable Fair Deepfake Detection
Yaning Zhang, Jiao Wu, Zan Gao +1
MixSearch: Searching for Domain Generalized Medical Image Segmentation Architectures
Luyan Liu, Zhiwei Wen, Songwei Liu +6
HairDiffusion: Vivid Multi-Colored Hair Editing via Latent Diffusion
Yu Zeng, Yang Zhang, Jiachen Liu +4
Output Constraint Transfer for Kernelized Correlation Filter in Tracking
Baochang Zhang, Zhigang Li, Xianbin Cao +5
OralGPT-Omni: A Versatile Dental Multimodal Large Language Model
Jing Hao, Yuci Liang, Lizhuo Lin +12
Activation Space Selectable Kolmogorov-Arnold Networks
Zhuoqin Yang, Jiansong Zhang, Xiaoling Luo +2
A Survey of Large Language Models for Perception and Measurement of Human Psychology
Yudong Li, Xiaoyi Chen, Jiawei Cai +4
ImplantMamba: Long-range Sequential Modeling Mamba For Dental Implant Position Prediction
Xinquan Yang, Congmin Wang, Xuguang Li +3
Any-to-Any Vision-Language Model for Multimodal X-ray Imaging and Radiological Report Generation
Daniele Molino, Francesco di Feola, Linlin Shen +2
GM-DF: Generalized Multi-Scenario Deepfake Detection
Yingxin Lai, Zitong Yu, Jing Yang +3
ReactMotion: Generating Reactive Listener Motions from Speaker Utterance
Cheng Luo, Bizhu Wu, Bing Li +5
Enhancing Adversarial Transferability by Balancing Exploration and Exploitation with Gradient-Guided Sampling
Zenghao Niu, Weicheng Xie, Siyang Song +3
MI^2GAN: Generative Adversarial Network for Medical Image Domain Adaptation using Mutual Information Constraint
Xinpeng Xie, Jiawei Chen, Yuexiang Li +3
SPF-Portrait: Towards Pure Text-to-Portrait Customization with Semantic Pollution-Free Fine-Tuning
Xiaole Xian, Zhichao Liao, Qingyu Li +6
Robust Representation via Dynamic Feature Aggregation
Haozhe Liu, Haoqin Ji, Yuexiang Li +5
MMedExpert-R1: Strengthening Multimodal Medical Reasoning via Domain-Specific Adaptation and Clinical Guideline Reinforcement
Meidan Ding, Jipeng Zhang, Wenxuan Wang +4
High-Performance Fine Defect Detection in Artificial Leather Using Dual Feature Pool Object Detection
Lin Huang, Weisheng Li, Yujuan Tan +2
Oral Imaging for Malocclusion Issues Assessments: OMNI Dataset, Deep Learning Baselines and Benchmarking
Pujun Xue, Junyi Ge, Xiaotong Jiang +8
Taming Self-Supervised Learning for Presentation Attack Detection: De-Folding and De-Mixing
Zhe Kong, Wentian Zhang, Feng Liu +4
TencentPretrain: A Scalable and Flexible Toolkit for Pre-training Models of Different Modalities
Zhe Zhao, Yudong Li, Cheng Hou +23
Cross Language Image Matching for Weakly Supervised Semantic Segmentation
Jinheng Xie, Xianxu Hou, Kai Ye +1
A Self-Organizing Tensor Architecture for Multi-View Clustering
Lifang He, Chun-ta Lu, Yong Chen +4
Multi-Dataset Multi-Task Learning for COVID-19 Prognosis
Filippo Ruffini, Lorenzo Tronchin, Zhuoru Wu +4
GuidedStyle: Attribute Knowledge Guided Style Manipulation for Semantic Face Editing
Xianxu Hou, Xiaokang Zhang, Linlin Shen +2
HySurvPred: Multimodal Hyperbolic Embedding with Angle-Aware Hierarchical Contrastive Learning and Uncertainty Constraints for Survival Prediction
Jiaqi Yang, Wenting Chen, Xiaohan Xing +5
WiNet: Wavelet-based Incremental Learning for Efficient Medical Image Registration
Xinxing Cheng, Xi Jia, Wenqi Lu +4
Category-Level 6D Object Pose Estimation with Flexible Vector-Based Rotation Representation
Wei Chen, Xi Jia, Zhongqun Zhang +4
Text Condition Embedded Regression Network for Automated Dental Abutment Design
Mianjie Zheng, Xinquan Yang, Xuguang Li +5
Manifold-preserved GANs
Haozhe Liu, Hanbang Liang, Xianxu Hou +3
CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute Editing
Xiaole Xian, Xilin He, Zenghao Niu +5
Inferring Dynamic Representations of Facial Actions from a Still Image
Siyang Song, Enrique Sánchez-Lozano, Linlin Shen +2
Deep Feature Consistent Variational Autoencoder
Xianxu Hou, Linlin Shen, Ke Sun +1
MedKAN: An Advanced Kolmogorov-Arnold Network for Medical Image Classification
Zhuoqin Yang, Jiansong Zhang, Xiaoling Luo +2
Selective Multi-Scale Learning for Object Detection
Junliang Chen, Weizeng Lu, Linlin Shen
Wavelet Integrated CNNs for Noise-Robust Image Classification
Qiufu Li, Linlin Shen, Sheng Guo +1
QUBIQ: Uncertainty Quantification for Biomedical Image Segmentation Challenge
Hongwei Bran Li, Fernando Navarro, Ivan Ezhov +77
EyePCR: A Comprehensive Benchmark for Fine-Grained Perception, Knowledge Comprehension and Clinical Reasoning in Ophthalmic Surgery
Gui Wang, Yang Wennuo, Xusen Ma +7
Contrastive learning of Class-agnostic Activation Map for Weakly Supervised Object Localization and Semantic Segmentation
Jinheng Xie, Jianfeng Xiang, Junliang Chen +3
Vision KAN: Towards an Attention-Free Backbone for Vision with Kolmogorov-Arnold Networks
Zhuoqin Yang, Jiansong Zhang, Xiaoling Luo +3
Context Aware 3D UNet for Brain Tumor Segmentation
Parvez Ahmad, Saqib Qamar, Linlin Shen +1
A Benchmark for Weakly Semi-Supervised Abnormality Localization in Chest X-Rays
Haoqin Ji, Haozhe Liu, Yuexiang Li +7
D^3-Talker: Dual-Branch Decoupled Deformation Fields for Few-Shot 3D Talking Head Synthesis
Yuhang Guo, Kaijun Deng, Siyang Song +3
YOLOCS: Object Detection based on Dense Channel Compression for Feature Spatial Solidification
Lin Huang, Weisheng Li, Yujuan Tan +3
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
Meidan Ding, Jipeng Zhang, Wenxuan Wang +6
Distilled Transformers with Locally Enhanced Global Representations for Face Forgery Detection
Yaning Zhang, Qiufu Li, Zitong Yu +1
Benchmarking Graph Representations and Graph Neural Networks for Multivariate Time Series Classification
Wennuo Yang, Shiling Wu, Yuzhi Zhou +5
Benchmarking Foundation Models and Parameter-Efficient Fine-Tuning for Prognosis Prediction in Medical Imaging
Filippo Ruffini, Elena Mulero Ayllon, Linlin Shen +2
LabelGS: Label-Aware 3D Gaussian Splatting for 3D Scene Segmentation
Yupeng Zhang, Dezhi Zheng, Ping Lu +8
ReactFace: Online Multiple Appropriate Facial Reaction Generation in Dyadic Interactions
Cheng Luo, Siyang Song, Weicheng Xie +4
Translate the Facial Regions You Like Using Region-Wise Normalization
Wenshuang Liu, Wenting Chen, Linlin Shen
X-ray Insights Unleashed: Pioneering the Enhancement of Multi-Label Long-Tail Data
Xinquan Yang, Jinheng Xie, Yawen Huang +6
CSL: A Large-scale Chinese Scientific Literature Dataset
Yudong Li, Yuqing Zhang, Zhe Zhao +4
Noise Invariant Frame Selection: A Simple Method to Address the Background Noise Problem for Text-independent Speaker Verification
Siyang Song, Shuimei Zhang, Björn Schuller +2
Improving Variational Autoencoder with Deep Feature Consistent and Generative Adversarial Training
Xianxu Hou, Ke Sun, Linlin Shen +1
ForensicZip: More Tokens are Better but Not Necessary in Forensic Vision-Language Models
Yingxin Lai, Zitong Yu, Jun Wang +3
SSAD: Self-supervised Auxiliary Detection Framework for Panoramic X-ray based Dental Disease Diagnosis
Zijian Cai, Xinquan Yang, Xuguang Li +5
Learning from Pseudo Lesion: A Self-supervised Framework for COVID-19 Diagnosis
Zhongliang Li, Zhihao Jin, Xuechen Li +1
GEM: Context-Aware Gaze EstiMation with Visual Search Behavior Matching for Chest Radiograph
Shaonan Liu, Wenting Chen, Jie Liu +2
Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models
Shaonan Liu, Guo Yu, Xiaoling Luo +4
GazeCLIP: Gaze-Guided CLIP with Adaptive-Enhanced Fine-Grained Language Prompt for Deepfake Attribution and Detection
Yaning Zhang, Linlin Shen, Zitong Yu +2
Simplify Implant Depth Prediction as Video Grounding: A Texture Perceive Implant Depth Prediction Network
Xinquan Yang, Xuguang Li, Xiaoling Luo +4
Online Refinement of Low-level Feature Based Activation Map for Weakly Supervised Object Localization
Jinheng Xie, Cheng Luo, Xiangping Zhu +3
DisFaceRep: Representation Disentanglement for Co-occurring Facial Components in Weakly Supervised Face Parsing
Xiaoqin Wang, Xianxu Hou, Meidan Ding +4
Medical Reasoning in the Era of LLMs: A Systematic Review of Enhancement Techniques and Applications
Wenxuan Wang, Zizhan Ma, Meidan Ding +8
Low-Light Enhancement Effect on Classification and Detection: An Empirical Study
Xu Wu, Zhihui Lai, Zhou Jie +4
Boosting Adversarial Transferability across Model Genus by Deformation-Constrained Warping
Qinliang Lin, Cheng Luo, Zenghao Niu +5
WaveSNet: Wavelet Integrated Deep Networks for Image Segmentation
Qiufu Li, Linlin Shen
SSA3D: Text-Conditioned Assisted Self-Supervised Framework for Automatic Dental Abutment Design
Mianjie Zheng, Xinquan Yang, Along He +6
Open-World Weakly-Supervised Object Localization
Jinheng Xie, Zhaochuan Luo, Yuexiang Li +3
Learning Graph Representation of Person-specific Cognitive Processes from Audio-visual Behaviours for Automatic Personality Recognition
Siyang Song, Zilong Shao, Shashank Jaiswal +3
DAMPER: A Dual-Stage Medical Report Generation Framework with Coarse-Grained MeSH Alignment and Fine-Grained Hypergraph Matching
Xiaofei Huang, Wenting Chen, Jie Liu +3
DIRCR: Dual-Inference Rule-Contrastive Reasoning for Solving RAVENs
Jiachen Zhang, Chengtai Li, Jianfeng Ren +3
Maximizing Incremental Information Entropy for Contrastive Learning
Jiansong Zhang, Zhuoqin Yang, Xu Wu +3
Taming Anomalies with Down-Up Sampling Networks: Group Center Preserving Reconstruction for 3D Anomaly Detection
Hanzhe Liang, Jie Zhang, Tao Dai +3
Active Learning for Breast Cancer Identification
Xinpeng Xie, Yuexiang Li, Linlin Shen
A Spectrum Evaluation Benchmark for Medical Multi-Modal Large Language Models
Jie Liu, Wenxuan Wang, Yihang Su +8
DinoDental: Benchmarking DINOv3 as a Unified Vision Encoder for Dental Image Analysis
Kun Tang, Xinquan Yang, Mianjie Zheng +6
Learning a Model-Driven Variational Network for Deformable Image Registration
Xi Jia, Alexander Thorley, Wei Chen +9
Towards Combating Frequency Simplicity-biased Learning for Domain Generalization
Xilin He, Jingyu Hu, Qinliang Lin +5
More than the Sum: Panorama-Language Models for Adverse Omni-Scenes
Weijia Fan, Ruiping Liu, Jiale Wei +7
Mammo-Clustering: Context Clustering based Multi-view Tri Level Information Fusion for Lesion Location and Classification in Mammography
Shilong Yang, Chulong Zhang, Xiaokun Liang +9
Question-Answer Cross Language Image Matching for Weakly Supervised Semantic Segmentation
Songhe Deng, Wei Zhuo, Jinheng Xie +1
Fine-Grained Image-Text Alignment in Medical Imaging Enables Explainable Cyclic Image-Report Generation
Wenting Chen, Linlin Shen, Jingyang Lin +3
TAVP: Task-Adaptive Visual Prompt for Cross-domain Few-shot Segmentation
Jiaqi Yang, Yaning Zhang, Jingxi Hu +3
Geometry Constrained Weakly Supervised Object Localization
Weizeng Lu, Xi Jia, Weicheng Xie +3
Bringing RGB and IR Together: Hierarchical Multi-Modal Enhancement for Robust Transmission Line Detection
Shengdong Zhang, Xiaoqin Zhang, Wenqi Ren +4
Imbalanced Data Learning by Minority Class Augmentation using Capsule Adversarial Networks
Pourya Shamsolmoali, Masoumeh Zareapoor, Linlin Shen +2