Publications (342)
DeepSolo++: Let Transformer Decoder with Explicit Points Solo for Multilingual Text Spotting
Maoyuan Ye, Jing Zhang, Shanshan Zhao +4
Multi-modal Auto-regressive Modeling via Visual Words
Tianshuo Peng, Zuchao Li, Lefei Zhang +3
CFLight: Enhancing Safety with Traffic Signal Control through Counterfactual Learning
Mingyuan Li, Chunyu Liu, Zhuojun Li +5
LSSANet: A Long Short Slice-Aware Network for Pulmonary Nodule Detection
Rui Xu, Yong Luo, Bo Du +2
Learn to Think: Improving Multimodal Reasoning through Vision-Aware Self-Improvement Training
Qihuang Zhong, Liang Ding, Wenjie Xuan +3
Indistinguishability-induced classical-to-nonclassical transition of photon statistics
Ao Shen, Bo Du, Ze-Hao Wang +4
Thermal-demagnetization-enhanced hybrid fiber-based thermometer coupled with nitrogen-vacancy centers
Shao-Chun Zhang, Shen Li, Bo Du +9
An Empirical Study of Remote Sensing Pretraining
Di Wang, Jing Zhang, Bo Du +2
PANDA: Prompt Transfer Meets Knowledge Distillation for Efficient Model Adaptation
Qihuang Zhong, Liang Ding, Juhua Liu +2
A robust fiber-based quantum thermometer coupled with nitrogen-vacancy centers
Shao-Chun Zhang, Yang Dong, Bo Du +7
DSDANet: Deep Siamese Domain Adaptation Convolutional Neural Network for Cross-domain Change Detection
Hongruixuan Chen, Chen Wu, Bo Du +1
Boosting Ultrasound Image Classification via Attribute-Guided Dual-Branch Framework
Bo Zhao, Yapeng Li, Juhua Liu +1
Learn from Downstream and Be Yourself in Multimodal Large Language Model Fine-Tuning
Wenke Huang, Jian Liang, Zekun Shi +6
SPEX: A Vision-Language Model for Land Cover Extraction on Spectral Remote Sensing Images
Dongchen Si, Di Wang, Erzhong Gao +9
Shifted Autoencoders for Point Annotation Restoration in Object Counting
Yuda Zou, Xin Xiao, Peilin Zhou +3
Synergistic Bleeding Region and Point Detection in Laparoscopic Surgical Videos
Jialun Pei, Zhangjun Zhou, Diandian Guo +4
Bypass Back-propagation: Optimization-based Structural Pruning for Large Language Models via Policy Gradient
Yuan Gao, Zujing Liu, Weizhong Zhang +2
GoMatching: A Simple Baseline for Video Text Spotting via Long and Short Term Matching
Haibin He, Maoyuan Ye, Jing Zhang +3
MBTI: A Multi-Branch Efficient Fine-Tuning Framework for Hyperspectral Image Classification with Foundation Models
Mingzhen Xu, Haonan Guo, Di Wang +9
The paper introduces MBTI, a multi-branch fine‑tuning framework that adapts hyperspectral foundation models to classification tasks while preserving full‑band spectral information…
Unified Multi-scale Feature Abstraction for Medical Image Segmentation
Xi Fang, Bo Du, Sheng Xu +2
TiMo: Spatiotemporal Foundation Model for Satellite Image Time Series
Xiaolei Qin, Di Wang, Jing Zhang +4
Concrete Subspace Learning based Interference Elimination for Multi-task Model Fusion
Anke Tang, Xianglin Luo, Li Shen +5
Knowledge Graph Augmented Network Towards Multiview Representation Learning for Aspect-based Sentiment Analysis
Qihuang Zhong, Liang Ding, Juhua Liu +3
Depth as Points: Center Point-based Depth Estimation
Zhiheng Tu, Xinjian Huang, Yong He +3
MTP: Advancing Remote Sensing Foundation Model via Multi-Task Pretraining
Di Wang, Jing Zhang, Minqiang Xu +8
Weakly-Supervised Semantic Segmentation with Visual Words Learning and Hybrid Pooling
Lixiang Ru, Bo Du, Yibing Zhan +1
Transformer for Object Re-Identification: A Survey
Mang Ye, Shuoyi Chen, Chenyue Li +3
Exchange Is All You Need for Remote Sensing Change Detection
Sijun Dong, Siming Fu, Kaiyu Li +3
3D Human Interaction Generation: A Survey
Siyuan Fan, Wenke Huang, Xiantao Cai +1
An Efficient Transformer for Simultaneous Learning of BEV and Lane Representations in 3D Lane Detection
Ziye Chen, Kate Smith-Miles, Bo Du +2
DeepSolo: Let Transformer Decoder with Explicit Points Solo for Text Spotting
Maoyuan Ye, Jing Zhang, Shanshan Zhao +4
HCGMNET: A Hierarchical Change Guiding Map Network For Change Detection
Chengxi Han, Chen Wu, Bo Du
M^3:Manipulation Mask Manufacturer for Arbitrary-Scale Super-Resolution Mask
Xinyu Yang, Xiaochen Ma, Xuekang Zhu +5
InverTune: Removing Backdoors from Multimodal Contrastive Learning Models via Trigger Inversion and Activation Tuning
Mengyuan Sun, Yu Li, Yuchen Liu +2
FUGC: Benchmarking Semi-Supervised Learning Methods for Cervical Segmentation
Jieyun Bai, Yitong Tang, Zihao Zhou +36
Remote Sensing ChatGPT: Solving Remote Sensing Tasks with ChatGPT and Visual Models
Haonan Guo, Xin Su, Chen Wu +3
DGSolver: Diffusion Generalist Solver with Universal Posterior Sampling for Image Restoration
Hebaixu Wang, Jing Zhang, Haonan Guo +3
Binary Change Guided Hyperspectral Multiclass Change Detection
Meiqi Hu, Chen Wu, Bo Du +1
Unlabeled Imperfect Demonstrations in Adversarial Imitation Learning
Yunke Wang, Bo Du, Chang Xu
Not All Instances Contribute Equally: Instance-adaptive Class Representation Learning for Few-Shot Visual Recognition
Mengya Han, Yibing Zhan, Yong Luo +4
Towards Unified Modeling in Federated Multi-Task Learning via Subspace Decoupling
Yipan Wei, Yuchen Zou, Yapeng Li +1
Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning
Qihuang Zhong, Liang Ding, Fei Liao +3
Robust Self-Ensembling Network for Hyperspectral Image Classification
Yonghao Xu, Bo Du, Liangpei Zhang
Hound: Hunting Supervision Signals for Few and Zero Shot Node Classification on Text-attributed Graph
Yuxiang Wang, Xiao Yan, Shiyu Jin +6
Fully Convolutional Change Detection Framework with Generative Adversarial Network for Unsupervised, Weakly Supervised and Regional Supervised Change Detection
Chen Wu, Bo Du, Liangpei Zhang
Rethink Sparse Signals for Pose-guided Text-to-image Generation
Wenjie Xuan, Jing Zhang, Juhua Liu +2
Fragment-Masked Diffusion for Molecular Optimization
Kun Li, Xiantao Cai, Jia Wu +4
CathAction: A Benchmark for Endovascular Intervention Understanding
Baoru Huang, Tuan Vo, Chayun Kongtongvattana +35
SGDA: Towards 3D Universal Pulmonary Nodule Detection via Slice Grouped Domain Attention
Rui Xu, Zhi Liu, Yong Luo +5
MobileSteward: Integrating Multiple App-Oriented Agents with Self-Evolution to Automate Cross-App Instructions
Yuxuan Liu, Hongda Sun, Wei Liu +3
Try, Check and Retry: A Divide-and-Conquer Framework for Boosting Long-context Tool-Calling Performance of LLMs
Kunfeng Chen, Qihuang Zhong, Juhua Liu +2
Toward Efficient Language Model Pretraining and Downstream Adaptation via Self-Evolution: A Case Study on SuperGLUE
Qihuang Zhong, Liang Ding, Yibing Zhan +11
DeepFake MNIST+: A DeepFake Facial Animation Dataset
Jiajun Huang, Xueyu Wang, Bo Du +2
Deeply-Supervised CNN for Prostate Segmentation
Qikui Zhu, Bo Du, Baris Turkbey +2
Behavioural Signatures of Risk-Sensitive Decision-Making in Large Language Models
Xuankun Rong, Wenke Huang, Bo Du +2
ET-SAM: Efficient Point Prompt Prediction in SAM for Unified Scene Text Detection and Layout Analysis
Xike Zhang, Maoyuan Ye, Juhua Liu +1
Demonstration of Efficient Predictive Surrogates for Large-scale Quantum Processors
Wei-You Liao, Yuxuan Du, Xinbiao Wang +5
Expression might be enough: representing pressure and demand for reinforcement learning based traffic signal control
Liang Zhang, Qiang Wu, Jun Shen +3
Expediting Building Footprint Extraction from High-resolution Remote Sensing Images via progressive lenient supervision
Haonan Guo, Bo Du, Chen Wu +2
BenchTemp: A General Benchmark for Evaluating Temporal Graph Neural Networks
Qiang Huang, Jiawei Jiang, Xi Susie Rao +10
Can We Build a Monolithic Model for Fake Image Detection? SICA: Semantic-Induced Constrained Adaptation for Unified-Yet-Discriminative Artifact Feature Space Reconstruction
Bo Du, Xiaochen Ma, Xuekang Zhu +8
Visual Imitation Learning with Calibrated Contrastive Representation
Yunke Wang, Linwei Tao, Bo Du +2
Tool Retrieval Bridge: Aligning Vague Instructions with Retriever Preferences via Bridge Model
Kunfeng Chen, Luyao Zhuang, Fei Liao +3
Designing and Training of A Dual CNN for Image Denoising
Chunwei Tian, Yong Xu, Wangmeng Zuo +3
ConRAG: Consensus-Driven Multi-View Retrieval for Multi-Hop Question Answering
Yikai Zhu, Kunfeng Chen, Qihuang Zhong +2
Adapting Segment Anything Model for Power Transmission Corridor Hazard Segmentation
Hang Chen, Maoyuan Ye, Peng Yang +3
Application of convolutional neural networks in image super-resolution
Chunwei Tian, Mingjian Song, Wangmeng Zuo +3
Revisiting Knowledge Distillation for Autoregressive Language Models
Qihuang Zhong, Liang Ding, Li Shen +3
Robust and Discriminative Labeling for Multi-label Active Learning Based on Maximum Correntropy Criterion
Bo Du, Zengmao Wang, Lefei Zhang +2
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
Weixi Song, Zuchao Li, Lefei Zhang +2
Online GNN Evaluation Under Test-time Graph Distribution Shifts
Xin Zheng, Dongjin Song, Qingsong Wen +2
AIMS: All-Inclusive Multi-Level Segmentation
Lu Qi, Jason Kuen, Weidong Guo +5
Robust Weight Perturbation for Adversarial Training
Chaojian Yu, Bo Han, Mingming Gong +4
What If the Input is Expanded in OOD Detection?
Boxuan Zhang, Jianing Zhu, Zengmao Wang +3
Soft-Prompting with Graph-of-Thought for Multi-modal Representation Learning
Juncheng Yang, Zuchao Li, Shuai Xie +3
EventTSF: Event-Aware Non-Stationary Time Series Forecasting
Yunfeng Ge, Ming Jin, Yiji Zhao +4
Stability and Generalization for Distributed SGDA
Miaoxi Zhu, Yan Sun, Li Shen +2
CLNode: Curriculum Learning for Node Classification
Xiaowen Wei, Xiuwen Gong, Yibing Zhan +3
Object Tracking in Satellite Videos Based on a Multi-Frame Optical Flow Tracker
Bo Du, Shihan Cai, Chen Wu +2
Benchmarking Reasoning Robustness in Large Language Models
Tong Yu, Yongcheng Jing, Xikun Zhang +6
Towards a Better Model with Dual Transformer for Drug Response Prediction
Kun Li, Jia Wu, Bo Du +4
WIA-LD2ND: Wavelet-based Image Alignment for Self-supervised Low-Dose CT Denoising
Haoyu Zhao, Yuliang Gu, Zhou Zhao +3
Diff-Font: Diffusion Model for Robust One-Shot Font Generation
Haibin He, Xinyuan Chen, Chaoyue Wang +4
MIFNet: Learning Modality-Invariant Features for Generalizable Multimodal Image Matching
Yepeng Liu, Zhichao Sun, Baosheng Yu +4
Simultaneous Spectral-Spatial Feature Selection and Extraction for Hyperspectral Images
Lefei Zhang, Qian Zhang, Bo Du +3
CrossEarth: Geospatial Vision Foundation Model for Domain Generalizable Remote Sensing Semantic Segmentation
Ziyang Gong, Zhixiang Wei, Di Wang +13
Iterative Data Generation with Large Language Models for Aspect-based Sentiment Analysis
Qihuang Zhong, Haiyun Li, Luyao Zhuang +2
Belief Memory: Agent Memory Under Partial Observability
Junfeng Liao, Qizhou Wang, Jianing Zhu +3
Dsfer-Net: A Deep Supervision and Feature Retrieval Network for Bitemporal Change Detection Using Modern Hopfield Networks
Shizhen Chang, Michael Kopp, Pedram Ghamisi +1
DeepCL: Deep Change Feature Learning on Remote Sensing Images in the Metric Space
Haonan Guo, Bo Du, Chen Wu +2
Careful Selection and Thoughtful Discarding: Graph Explicit Pooling Utilizing Discarded Nodes
Chuang Liu, Wenhang Yu, Kuang Gao +5
Change Detection in Multi-temporal VHR Images Based on Deep Siamese Multi-scale Convolutional Networks
Hongruixuan Chen, Chen Wu, Bo Du +1
DSA-SRGS: Super-Resolution Gaussian Splatting for Dynamic Sparse-View DSA Reconstruction
Shiyu Zhang, Zhicong Wu, Huangxuan Zhao +7
Reasoning-OCR: Can Large Multimodal Models Solve Complex Logical Reasoning Problems from OCR Cues?
Haibin He, Maoyuan Ye, Jing Zhang +4
A multi-task convolutional neural network for mega-city analysis using very high resolution satellite imagery and geospatial data
Fan Zhang, Bo Du, Liangpei Zhang
Joint Learning Neuronal Skeleton and Brain Circuit Topology with Permutation Invariant Encoders for Neuron Classification
Minghui Liao, Guojia Wan, Bo Du
MixSiam: A Mixture-based Approach to Self-supervised Representation Learning
Xiaoyang Guo, Tianhao Zhao, Yutian Lin +1
Federated Learning with Only Positive Labels by Exploring Label Correlations
Xuming An, Dui Wang, Li Shen +5
SGEN: Single-cell Sequencing Graph Self-supervised Embedding Network
Ziyi Liu, Minghui Liao, Fulin luo +1
SMILE: Zero-Shot Sparse Mixture of Low-Rank Experts Construction From Pre-Trained Foundation Models
Anke Tang, Li Shen, Yong Luo +5