Publications (130)
Bridging the Sim-to-Real Gap from the Information Bottleneck Perspective
Haoran He, Peilin Wu, Chenjia Bai +5
Natural Language Induced Adversarial Images
Xiaopei Zhu, Peiyang Xu, Guanning Zeng +2
Enhancing Spectrogram Realism in Singing Voice Synthesis via Explicit Bandwidth Extension Prior to Vocoder
Runxuan Yang, Kai Li, Guo Chen +1
PartImageNet++ Dataset: Enhancing Visual Models with High-Quality Part Annotations
Xiao Li, Zilong Liu, Yining Liu +4
Convolutional Neural Networks with Gated Recurrent Connections
Jianfeng Wang, Xiaolin Hu
VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples
Qixin Sun, Ziqin Wang, Hengyuan Zhao +6
Estimation of the volume of the left ventricle from MRI images using deep neural networks
Fangzhou Liao, Xi Chen, Xiaolin Hu +1
Defense against Adversarial Attacks Using High-Level Representation Guided Denoiser
Fangzhou Liao, Ming Liang, Yinpeng Dong +3
Look Closer to Segment Better: Boundary Patch Refinement for Instance Segmentation
Chufeng Tang, Hang Chen, Xiao Li +3
Generalized Focal Loss: Learning Qualified and Distributed Bounding Boxes for Dense Object Detection
Xiang Li, Wenhai Wang, Lijun Wu +5
MiVE: Multiscale Vision-language features for reference-guided video Editing
Tong Wang, Meng Zou, Chengjing Wu +4
NP-Match: Towards a New Probabilistic Model for Semi-Supervised Learning
Jianfeng Wang, Xiaolin Hu, Thomas Lukasiewicz
The SonicAGI System for the REAL-TSE Challenge
Kai Li, Wendi Sang, Jintao Cheng +1
The paper presents SonicAGI, a system for real-world target speaker extraction that combines simulated and real meeting data, using a low‑latency SwiftNet-Lookahead model for onlin…
Difference-Driven Gating: Adaptive Feature Fusion for U-Net Decoder
Kai Li, Xuechao Zou, Jiashen Fu +3
The paper introduces two difference-driven gating mechanisms that adaptively fuse high‑level and low‑level features in U‑Net decoders, improving performance on tasks like medical i…
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
Qibin Wang, Xiaolin Hu, Weikai Xu +3
DeepInv: A Novel Self-supervised Learning Approach for Fast and Accurate Diffusion Inversion
Ziyue Zhang, Luxi Lin, Xiaolin Hu +4
Amplification trojan network: Attack deep neural networks by amplifying their inherent weakness
Zhanhao Hu, Jun Zhu, Bo Zhang +1
Interlinked Convolutional Neural Networks for Face Parsing
Yisu Zhou, Xiaolin Hu, Bo Zhang
Language-Driven Anchors for Zero-Shot Adversarial Robustness
Xiao Li, Wei Zhang, Yining Liu +3
A Brain-Inspired Deep Separation Network for Single Channel Raman Spectra Unmixing
Gaoruishu Long, Jinchao Liu, Bo Liu +2
Adversarial Attacks and Defences Competition
Alexey Kurakin, Ian Goodfellow, Samy Bengio +20
Adversarial Texture for Fooling Person Detectors in the Physical World
Zhanhao Hu, Siyuan Huang, Xiaopei Zhu +3
RSG: A Simple but Effective Module for Learning Imbalanced Datasets
Jianfeng Wang, Thomas Lukasiewicz, Xiaolin Hu +2
Fooling thermal infrared pedestrian detectors in real world using small bulbs
Xiaopei Zhu, Xiao Li, Jianmin Li +2
Evaluate the Malignancy of Pulmonary Nodules Using the 3D Deep Leaky Noisy-or Network
Fangzhou Liao, Ming Liang, Zhe Li +2
Visual Recognition by Request
Chufeng Tang, Lingxi Xie, Xiaopeng Zhang +2
AudioTrust: Benchmarking the Multifaceted Trustworthiness of Audio Large Language Models
Kai Li, Can Shen, Yile Liu +31
Selective Kernel Networks
Xiang Li, Wenhai Wang, Xiaolin Hu +1
Adjacency constraint for efficient hierarchical reinforcement learning
Tianren Zhang, Shangqi Guo, Tian Tan +2
Speech Separation Using an Asynchronous Fully Recurrent Convolutional Neural Network
Xiaolin Hu, Kai Li, Weiyi Zhang +3
NP-Match: When Neural Processes meet Semi-Supervised Learning
Jianfeng Wang, Thomas Lukasiewicz, Daniela Massiceti +3
SPMamba: State-space model is all you need in speech separation
Kai Li, Guo Chen, Runxuan Yang +1
Audio-Visual Speech Separation in Noisy Environments with a Lightweight Iterative Model
Héctor Martel, Julius Richter, Kai Li +2
Attack on practical speaker verification system using universal adversarial perturbations
Weiyi Zhang, Shuning Zhao, Le Liu +4
Neural Retrievers are Biased Towards LLM-Generated Content
Sunhao Dai, Yuqi Zhou, Liang Pang +6
Chemical knowledge-informed framework for privacy-aware retrosynthesis learning
Guikun Chen, Xu Zhang, Xiaolin Hu +3
Pixel Embedding Method for Tubular Neurite Segmentation
Huayu Fu, Jiamin Li, Haozhi Qu +2
MTADiffusion: Mask Text Alignment Diffusion Model for Object Inpainting
Jun Huang, Ting Liu, Yihang Wu +3
IIANet: An Intra- and Inter-Modality Attention Network for Audio-Visual Speech Separation
Kai Li, Runxuan Yang, Fuchun Sun +1
GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing
Tong Wang, Ting Liu, Xiaochao Qu +3
Physically Realizable Natural-Looking Clothing Textures Evade Person Detectors via 3D Modeling
Zhanhao Hu, Wenda Chu, Xiaopei Zhu +3
NP-SemiSeg: When Neural Processes meet Semi-Supervised Semantic Segmentation
Jianfeng Wang, Daniela Massiceti, Xiaolin Hu +2
Defending against Patch-Based and Texture-Based Adversarial Attacks with Spectral Decomposition
Wei Zhang, Xinyu Chang, Xiao Li +2
On the Privacy Effect of Data Enhancement via the Lens of Memorization
Xiao Li, Qiongxiu Li, Zhanhao Hu +1
Frame Difference-Based Temporal Loss for Video Stylization
Jianjin Xu, Zheyang Xiong, Xiaolin Hu
Bridging the Gap Between Training and Inference of Bayesian Controllable Language Models
Han Liu, Bingning Wang, Ting Yao +3
Dynamic Multi-path Neural Network
Yingcheng Su, Shunfeng Zhou, Yichao Wu +7
PBCAT: Patch-based composite adversarial training against physically realizable attacks on object detection
Xiao Li, Yiming Zhu, Yifan Huang +4
Crafting Physical Adversarial Examples by Combining Differentiable and Physically Based Renders
Yuqiu Liu, Huanqian Yan, Xiaopei Zhu +4
Drug repositioning for Alzheimer's disease with transfer learning
Yetao Wu, Han Liu, Jie Yan +1
Interpretable Disentanglement of Neural Networks by Extracting Class-Specific Subnetwork
Yulong Wang, Xiaolin Hu, Hang Su
Accurate and Reliable Predictions with Mutual-Transport Ensemble
Han Liu, Peng Cui, Bingning Wang +2
Understanding the Disharmony between Dropout and Batch Normalization by Variance Shift
Xiang Li, Shuo Chen, Xiaolin Hu +1
End-to-End Face Parsing via Interlinked Convolutional Neural Networks
Zi Yin, Valentin Yiu, Xiaolin Hu +1
Pruning from Scratch
Yulong Wang, Xiaolu Zhang, Lingxi Xie +4
A Semantics-Assisted Video Captioning Model Trained with Scheduled Sampling
Haoran Chen, Ke Lin, Alexander Maye +2
A$^2$-LLM: An End-to-end Conversational Audio Avatar Large Language Model
Xiaolin Hu, Hang Yuan, Xinzhu Sang +4
RTFS-Net: Recurrent Time-Frequency Modelling for Efficient Audio-Visual Speech Separation
Samuel Pegg, Kai Li, Xiaolin Hu
TDFNet: An Efficient Audio-Visual Speech Separation Model with Top-down Fusion
Samuel Pegg, Kai Li, Xiaolin Hu
Time-Frequency-Based Attention Cache Memory Model for Real-Time Speech Separation
Guo Chen, Kai Li, Runxuan Yang +1
HEDNet: A Hierarchical Encoder-Decoder Network for 3D Object Detection in Point Clouds
Gang Zhang, Junnan Chen, Guohuan Gao +2
Turbo Learning Framework for Human-Object Interactions Recognition and Human Pose Estimation
Wei Feng, Wentao Liu, Tong Li +3
Improving Pedestrian Attribute Recognition With Weakly-Supervised Multi-Scale Attribute-Specific Localization
Chufeng Tang, Lu Sheng, Zhaoxiang Zhang +1
Extracting Semantic Knowledge from GANs with Unsupervised Learning
Jianjin Xu, Zhaoxiang Zhang, Xiaolin Hu
An Audio-Visual Speech Separation Model Inspired by Cortico-Thalamo-Cortical Circuits
Kai Li, Fenghua Xie, Hang Chen +2
PhysBrain 1.0 Technical Report
Shijie Lian, Bin Yu, Xiaopeng Lin +10
Beyond the Black Box: A Survey on the Theory and Mechanism of Large Language Models
Zeyu Gan, Ruifeng Ren, Wei Yao +9
The Winning Solution to the iFLYTEK Challenge 2021 Cultivated Land Extraction from High-Resolution Remote Sensing Image
Zhen Zhao, Yuqiu Liu, Gang Zhang +2
RefineMask: Towards High-Quality Instance Segmentation with Fine-Grained Features
Gang Zhang, Xin Lu, Jingru Tan +4
Scale-Aware Face Detection
Zekun Hao, Yu Liu, Hongwei Qin +3
Delving Deeper into the Decoder for Video Captioning
Haoran Chen, Jianmin Li, Xiaolin Hu
FGNet: Leveraging Feature-Guided Attention to Refine SAM2 for 3D EM Neuron Segmentation
Zhenghua Li, Hang Chen, Zihao Sun +2
SAFDNet: A Simple and Effective Network for Fully Sparse 3D Object Detection
Gang Zhang, Junnan Chen, Guohuan Gao +3
2D Gaussians Meet Visual Tokenizer
Yiang Shi, Xiaoyang Guo, Wei Yin +5
Enhancing In-Context Learning Performance with just SVD-Based Weight Pruning: A Theoretical Perspective
Xinhao Yao, Xiaolin Hu, Shenzhi Yang +1
CooHOI: Learning Cooperative Human-Object Interaction with Manipulated Object Dynamics
Jiawei Gao, Ziqin Wang, Zeqi Xiao +7
DanceCrafter: Fine-Grained Text-Driven Controllable Dance Generation via Choreographic Syntax
Hang Yuan, Xiaolin Hu, Yan Wan +8
Rethinking Natural Adversarial Examples for Classification Models
Xiao Li, Jianmin Li, Ting Dai +3
Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models
Xiao Li, Wei Zhang, Zhuhong Li +6
Meta Semantics: Towards better natural language understanding and reasoning
Xiaolin Hu
Diachronic Sample Integration: Robust Tail-Risk Estimation with Generative Models
Shuning Zhao, Patrick Wong, Leran Zhang +1
Knowledge Distillation via Route Constrained Optimization
Xiao Jin, Baoyun Peng, Yichao Wu +5
CEDNet: A Cascade Encoder-Decoder Network for Dense Prediction
Gang Zhang, Ziyi Li, Chufeng Tang +2
A Reverse Hierarchy Model for Predicting Eye Fixations
Tianlin Shi, Liang Ming, Xiaolin Hu
The MSR-Video to Text Dataset with Clean Annotations
Haoran Chen, Jianmin Li, Simone Frintrop +1
Recognizing Object by Components with Human Prior Knowledge Enhances Adversarial Robustness of Deep Neural Networks
Xiao Li, Ziqi Wang, Bo Zhang +2
Boosting Adversarial Attacks with Momentum
Yinpeng Dong, Fangzhou Liao, Tianyu Pang +4
MIXPGD: Hybrid Adversarial Training for Speech Recognition Systems
Aminul Huq, Weiyi Zhang, Xiaolin Hu
How Mobile World Model Guides GUI Agents?
Weikai Xu, Kun Huang, Yunren Feng +10
DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models
Xiaolin Hu, Xiang Cheng, Peiyu Liu +4
A Turbo-Inference Strategy for Object Detection and Instance Segmentation
Zhen Zhao, Gang Zhang, Xiaolin Hu +1
Generalized Focal Loss V2: Learning Reliable Localization Quality Estimation for Dense Object Detection
Xiang Li, Wenhai Wang, Xiaolin Hu +3
Advances in Speech Separation: Techniques, Challenges, and Future Trends
Kai Li, Guo Chen, Wendi Sang +8
On the Importance of Backbone to the Adversarial Robustness of Object Detectors
Xiao Li, Hang Chen, Xiaolin Hu
Full-ECE: A Metric For Token-level Calibration on Large Language Models
Han Liu, Yupeng Zhang, Bingning Wang +2
Theoretical Insights into Fine-Tuning Attention Mechanism: Generalization and Optimization
Xinhao Yao, Hongjin Qian, Xiaolin Hu +5
Generating Adjacency-Constrained Subgoals in Hierarchical Reinforcement Learning
Tianren Zhang, Shangqi Guo, Tian Tan +2
Active Pointly-Supervised Instance Segmentation
Chufeng Tang, Lingxi Xie, Gang Zhang +3
CloudAAE: Learning 6D Object Pose Regression with On-line Data Synthesis on Point Clouds
Ge Gao, Mikko Lauri, Xiaolin Hu +2
Between a Rock and a Hard Place: The Tension Between Ethical Reasoning and Safety Alignment in LLMs
Shei Pern Chua, Zhen Leng Thai, Kai Jun Teh +3