NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (130)

cs.LG2024

Bridging the Sim-to-Real Gap from the Information Bottleneck Perspective

Haoran He, Peilin Wu, Chenjia Bai +5

cs.CR2024

Natural Language Induced Adversarial Images

Xiaopei Zhu, Peiyang Xu, Guanning Zeng +2

cs.SD2025

Enhancing Spectrogram Realism in Singing Voice Synthesis via Explicit Bandwidth Extension Prior to Vocoder

Runxuan Yang, Kai Li, Guo Chen +1

cs.CV2026

PartImageNet++ Dataset: Enhancing Visual Models with High-Quality Part Annotations

Xiao Li, Zilong Liu, Yining Liu +4

cs.CV2021

Convolutional Neural Networks with Gated Recurrent Connections

Jianfeng Wang, Xiaolin Hu

cs.CL2025

VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples

Qixin Sun, Ziqin Wang, Hengyuan Zhao +6

cs.CV2017

Estimation of the volume of the left ventricle from MRI images using deep neural networks

Fangzhou Liao, Xi Chen, Xiaolin Hu +1

cs.CV2018

Defense against Adversarial Attacks Using High-Level Representation Guided Denoiser

Fangzhou Liao, Ming Liang, Yinpeng Dong +3

cs.CV2021

Look Closer to Segment Better: Boundary Patch Refinement for Instance Segmentation

Chufeng Tang, Hang Chen, Xiao Li +3

cs.CV2020

Generalized Focal Loss: Learning Qualified and Distributed Bounding Boxes for Dense Object Detection

Xiang Li, Wenhai Wang, Lijun Wu +5

cs.CV2026

MiVE: Multiscale Vision-language features for reference-guided video Editing

Tong Wang, Meng Zou, Chengjing Wu +4

cs.CV2023

NP-Match: Towards a New Probabilistic Model for Semi-Supervised Learning

Jianfeng Wang, Xiaolin Hu, Thomas Lukasiewicz

cs.SD2026

The SonicAGI System for the REAL-TSE Challenge

Kai Li, Wendi Sang, Jintao Cheng +1

The paper presents SonicAGI, a system for real-world target speaker extraction that combines simulated and real meeting data, using a low‑latency SwiftNet-Lookahead model for onlin…

#target speaker extraction#low‑latency online separation#data‑centric training#cross‑attention
cs.CV2026

Difference-Driven Gating: Adaptive Feature Fusion for U-Net Decoder

Kai Li, Xuechao Zou, Jiashen Fu +3

The paper introduces two difference-driven gating mechanisms that adaptively fuse high‑level and low‑level features in U‑Net decoders, improving performance on tasks like medical i…

#u-net#feature fusion#attention mechanisms#image segmentation
cs.CL2024

PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning

Qibin Wang, Xiaolin Hu, Weikai Xu +3

cs.CV2026

DeepInv: A Novel Self-supervised Learning Approach for Fast and Accurate Diffusion Inversion

Ziyue Zhang, Luxi Lin, Xiaolin Hu +4

cs.CR2023

Amplification trojan network: Attack deep neural networks by amplifying their inherent weakness

Zhanhao Hu, Jun Zhu, Bo Zhang +1

cs.CV2018

Interlinked Convolutional Neural Networks for Face Parsing

Yisu Zhou, Xiaolin Hu, Bo Zhang

cs.CV2024

Language-Driven Anchors for Zero-Shot Adversarial Robustness

Xiao Li, Wei Zhang, Yining Liu +3

cs.LG2026

A Brain-Inspired Deep Separation Network for Single Channel Raman Spectra Unmixing

Gaoruishu Long, Jinchao Liu, Bo Liu +2

cs.CV2018

Adversarial Attacks and Defences Competition

Alexey Kurakin, Ian Goodfellow, Samy Bengio +20

cs.CV2022

Adversarial Texture for Fooling Person Detectors in the Physical World

Zhanhao Hu, Siyuan Huang, Xiaopei Zhu +3

cs.CV2021

RSG: A Simple but Effective Module for Learning Imbalanced Datasets

Jianfeng Wang, Thomas Lukasiewicz, Xiaolin Hu +2

cs.CV2023

Fooling thermal infrared pedestrian detectors in real world using small bulbs

Xiaopei Zhu, Xiao Li, Jianmin Li +2

cs.CV2017

Evaluate the Malignancy of Pulmonary Nodules Using the 3D Deep Leaky Noisy-or Network

Fangzhou Liao, Ming Liang, Zhe Li +2

cs.CV2022

Visual Recognition by Request

Chufeng Tang, Lingxi Xie, Xiaopeng Zhang +2

cs.SD2026

AudioTrust: Benchmarking the Multifaceted Trustworthiness of Audio Large Language Models

Kai Li, Can Shen, Yile Liu +31

cs.CV2019

Selective Kernel Networks

Xiang Li, Wenhai Wang, Xiaolin Hu +1

cs.LG2022

Adjacency constraint for efficient hierarchical reinforcement learning

Tianren Zhang, Shangqi Guo, Tian Tan +2

cs.SD2021

Speech Separation Using an Asynchronous Fully Recurrent Convolutional Neural Network

Xiaolin Hu, Kai Li, Weiyi Zhang +3

cs.LG2022

NP-Match: When Neural Processes meet Semi-Supervised Learning

Jianfeng Wang, Thomas Lukasiewicz, Daniela Massiceti +3

cs.SD2024

SPMamba: State-space model is all you need in speech separation

Kai Li, Guo Chen, Runxuan Yang +1

eess.AS2023

Audio-Visual Speech Separation in Noisy Environments with a Lightweight Iterative Model

Héctor Martel, Julius Richter, Kai Li +2

cs.SD2021

Attack on practical speaker verification system using universal adversarial perturbations

Weiyi Zhang, Shuning Zhao, Le Liu +4

cs.IR2024

Neural Retrievers are Biased Towards LLM-Generated Content

Sunhao Dai, Yuqi Zhou, Liang Pang +6

cs.LG2025

Chemical knowledge-informed framework for privacy-aware retrosynthesis learning

Guikun Chen, Xu Zhang, Xiaolin Hu +3

eess.IV2025

Pixel Embedding Method for Tubular Neurite Segmentation

Huayu Fu, Jiamin Li, Haozhi Qu +2

cs.CV2025

MTADiffusion: Mask Text Alignment Diffusion Model for Object Inpainting

Jun Huang, Ting Liu, Yihang Wu +3

cs.SD2024

IIANet: An Intra- and Inter-Modality Attention Network for Audio-Visual Speech Separation

Kai Li, Runxuan Yang, Fuchun Sun +1

cs.CV2025

GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing

Tong Wang, Ting Liu, Xiaochao Qu +3

cs.CV2024

Physically Realizable Natural-Looking Clothing Textures Evade Person Detectors via 3D Modeling

Zhanhao Hu, Wenda Chu, Xiaopei Zhu +3

cs.CV2023

NP-SemiSeg: When Neural Processes meet Semi-Supervised Semantic Segmentation

Jianfeng Wang, Daniela Massiceti, Xiaolin Hu +2

cs.CV2026

Defending against Patch-Based and Texture-Based Adversarial Attacks with Spectral Decomposition

Wei Zhang, Xinyu Chang, Xiao Li +2

cs.LG2024

On the Privacy Effect of Data Enhancement via the Lens of Memorization

Xiao Li, Qiongxiu Li, Zhanhao Hu +1

cs.CV2021

Frame Difference-Based Temporal Loss for Video Stylization

Jianjin Xu, Zheyang Xiong, Xiaolin Hu

cs.CL2022

Bridging the Gap Between Training and Inference of Bayesian Controllable Language Models

Han Liu, Bingning Wang, Ting Yao +3

cs.CV2019

Dynamic Multi-path Neural Network

Yingcheng Su, Shunfeng Zhou, Yichao Wu +7

cs.CV2025

PBCAT: Patch-based composite adversarial training against physically realizable attacks on object detection

Xiao Li, Yiming Zhu, Yifan Huang +4

cs.GR2025

Crafting Physical Adversarial Examples by Combining Differentiable and Physically Based Renders

Yuqiu Liu, Huanqian Yan, Xiaopei Zhu +4

q-bio.QM2022

Drug repositioning for Alzheimer's disease with transfer learning

Yetao Wu, Han Liu, Jie Yan +1

cs.LG2019

Interpretable Disentanglement of Neural Networks by Extracting Class-Specific Subnetwork

Yulong Wang, Xiaolin Hu, Hang Su

cs.AI2024

Accurate and Reliable Predictions with Mutual-Transport Ensemble

Han Liu, Peng Cui, Bingning Wang +2

cs.LG2018

Understanding the Disharmony between Dropout and Batch Normalization by Variance Shift

Xiang Li, Shuo Chen, Xiaolin Hu +1

cs.CV2020

End-to-End Face Parsing via Interlinked Convolutional Neural Networks

Zi Yin, Valentin Yiu, Xiaolin Hu +1

cs.CV2019

Pruning from Scratch

Yulong Wang, Xiaolu Zhang, Lingxi Xie +4

cs.CV2020

A Semantics-Assisted Video Captioning Model Trained with Scheduled Sampling

Haoran Chen, Ke Lin, Alexander Maye +2

cs.LG2026

A$^2$-LLM: An End-to-end Conversational Audio Avatar Large Language Model

Xiaolin Hu, Hang Yuan, Xinzhu Sang +4

cs.SD2024

RTFS-Net: Recurrent Time-Frequency Modelling for Efficient Audio-Visual Speech Separation

Samuel Pegg, Kai Li, Xiaolin Hu

cs.SD2024

TDFNet: An Efficient Audio-Visual Speech Separation Model with Top-down Fusion

Samuel Pegg, Kai Li, Xiaolin Hu

cs.SD2025

Time-Frequency-Based Attention Cache Memory Model for Real-Time Speech Separation

Guo Chen, Kai Li, Runxuan Yang +1

cs.CV2023

HEDNet: A Hierarchical Encoder-Decoder Network for 3D Object Detection in Point Clouds

Gang Zhang, Junnan Chen, Guohuan Gao +2

cs.CV2019

Turbo Learning Framework for Human-Object Interactions Recognition and Human Pose Estimation

Wei Feng, Wentao Liu, Tong Li +3

cs.CV2019

Improving Pedestrian Attribute Recognition With Weakly-Supervised Multi-Scale Attribute-Specific Localization

Chufeng Tang, Lu Sheng, Zhaoxiang Zhang +1

cs.CV2022

Extracting Semantic Knowledge from GANs with Unsupervised Learning

Jianjin Xu, Zhaoxiang Zhang, Xiaolin Hu

cs.SD2024

An Audio-Visual Speech Separation Model Inspired by Cortico-Thalamo-Cortical Circuits

Kai Li, Fenghua Xie, Hang Chen +2

cs.RO2026

PhysBrain 1.0 Technical Report

Shijie Lian, Bin Yu, Xiaopeng Lin +10

cs.CL2026

Beyond the Black Box: A Survey on the Theory and Mechanism of Large Language Models

Zeyu Gan, Ruifeng Ren, Wei Yao +9

cs.CV2022

The Winning Solution to the iFLYTEK Challenge 2021 Cultivated Land Extraction from High-Resolution Remote Sensing Image

Zhen Zhao, Yuqiu Liu, Gang Zhang +2

cs.CV2021

RefineMask: Towards High-Quality Instance Segmentation with Fine-Grained Features

Gang Zhang, Xin Lu, Jingru Tan +4

cs.CV2017

Scale-Aware Face Detection

Zekun Hao, Yu Liu, Hongwei Qin +3

cs.CV2020

Delving Deeper into the Decoder for Video Captioning

Haoran Chen, Jianmin Li, Xiaolin Hu

cs.CV2025

FGNet: Leveraging Feature-Guided Attention to Refine SAM2 for 3D EM Neuron Segmentation

Zhenghua Li, Hang Chen, Zihao Sun +2

cs.CV2024

SAFDNet: A Simple and Effective Network for Fully Sparse 3D Object Detection

Gang Zhang, Junnan Chen, Guohuan Gao +3

cs.CV2025

2D Gaussians Meet Visual Tokenizer

Yiang Shi, Xiaoyang Guo, Wei Yin +5

cs.LG2024

Enhancing In-Context Learning Performance with just SVD-Based Weight Pruning: A Theoretical Perspective

Xinhao Yao, Xiaolin Hu, Shenzhi Yang +1

cs.RO2024

CooHOI: Learning Cooperative Human-Object Interaction with Manipulated Object Dynamics

Jiawei Gao, Ziqin Wang, Zeqi Xiao +7

cs.CV2026

DanceCrafter: Fine-Grained Text-Driven Controllable Dance Generation via Choreographic Syntax

Hang Yuan, Xiaolin Hu, Yan Wan +8

cs.CV2021

Rethinking Natural Adversarial Examples for Classification Models

Xiao Li, Jianmin Li, Ting Dai +3

cs.LG2026

Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models

Xiao Li, Wei Zhang, Zhuhong Li +6

cs.CL2023

Meta Semantics: Towards better natural language understanding and reasoning

Xiaolin Hu

cs.LG2026

Diachronic Sample Integration: Robust Tail-Risk Estimation with Generative Models

Shuning Zhao, Patrick Wong, Leran Zhang +1

cs.LG2019

Knowledge Distillation via Route Constrained Optimization

Xiao Jin, Baoyun Peng, Yichao Wu +5

cs.CV2023

CEDNet: A Cascade Encoder-Decoder Network for Dense Prediction

Gang Zhang, Ziyi Li, Chufeng Tang +2

cs.CV2014

A Reverse Hierarchy Model for Predicting Eye Fixations

Tianlin Shi, Liang Ming, Xiaolin Hu

cs.CV2024

The MSR-Video to Text Dataset with Clean Annotations

Haoran Chen, Jianmin Li, Simone Frintrop +1

cs.CV2022

Recognizing Object by Components with Human Prior Knowledge Enhances Adversarial Robustness of Deep Neural Networks

Xiao Li, Ziqi Wang, Bo Zhang +2

cs.LG2018

Boosting Adversarial Attacks with Momentum

Yinpeng Dong, Fangzhou Liao, Tianyu Pang +4

cs.SD2023

MIXPGD: Hybrid Adversarial Training for Speech Recognition Systems

Aminul Huq, Weiyi Zhang, Xiaolin Hu

cs.AI2026

How Mobile World Model Guides GUI Agents?

Weikai Xu, Kun Huang, Yunren Feng +10

cs.CL2024

DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models

Xiaolin Hu, Xiang Cheng, Peiyu Liu +4

cs.CV2026

A Turbo-Inference Strategy for Object Detection and Instance Segmentation

Zhen Zhao, Gang Zhang, Xiaolin Hu +1

cs.CV2020

Generalized Focal Loss V2: Learning Reliable Localization Quality Estimation for Dense Object Detection

Xiang Li, Wenhai Wang, Xiaolin Hu +3

cs.SD2025

Advances in Speech Separation: Techniques, Challenges, and Future Trends

Kai Li, Guo Chen, Wendi Sang +8

cs.CV2025

On the Importance of Backbone to the Adversarial Robustness of Object Detectors

Xiao Li, Hang Chen, Xiaolin Hu

cs.CL2024

Full-ECE: A Metric For Token-level Calibration on Large Language Models

Han Liu, Yupeng Zhang, Bingning Wang +2

cs.LG2025

Theoretical Insights into Fine-Tuning Attention Mechanism: Generalization and Optimization

Xinhao Yao, Hongjin Qian, Xiaolin Hu +5

cs.LG2021

Generating Adjacency-Constrained Subgoals in Hierarchical Reinforcement Learning

Tianren Zhang, Shangqi Guo, Tian Tan +2

cs.CV2022

Active Pointly-Supervised Instance Segmentation

Chufeng Tang, Lingxi Xie, Gang Zhang +3

cs.CV2021

CloudAAE: Learning 6D Object Pose Regression with On-line Data Synthesis on Point Clouds

Ge Gao, Mikko Lauri, Xiaolin Hu +2

cs.CR2026

Between a Rock and a Hard Place: The Tension Between Ethical Reasoning and Safety Alignment in LLMs

Shei Pern Chua, Zhen Leng Thai, Kai Jun Teh +3