papers

Publications (33)

cs.LG2026

S2O: Early Stopping for Sparse Attention via Online Permutation

Yu Zhang, Songwei Liu, Chenqian Yan +4

cs.LG2021

Efficient Micro-Structured Weight Unification and Pruning for Neural Network Compression

Sheng Lin, Wei Jiang, Wei Wang +4

eess.IV2019

Deep Compressed Pneumonia Detection for Low-Power Embedded Devices

Hongjia Li, Sheng Lin, Ning Liu +2

cs.AR2021

FORMS: Fine-grained Polarized ReRAM-based In-situ Computation for Mixed-signal DNN Accelerator

Geng Yuan, Payman Behnam, Zhengang Li +8

cs.NE2023

Towards Zero Memory Footprint Spiking Neural Network Training

Bin Lei, Sheng Lin, Pei-Hung Lin +2

cs.LG2018

Learning Topics using Semantic Locality

Ziyi Zhao, Krittaphat Pugdeethosapol, Sheng Lin +4

cs.CR2021

ESMFL: Efficient and Secure Models for Federated Learning

Sheng Lin, Chenghong Wang, Hongjia Li +3

eess.SP2019

Tiny but Accurate: A Pruned, Quantized and Optimized Memristor Crossbar Framework for Ultra Efficient DNN Implementation

Xiaolong Ma, Geng Yuan, Sheng Lin +6

eess.IV2022

FAIVConf: Face enhancement for AI-based Video Conference with Low Bit-rate

Zhengang Li, Sheng Lin, Shan Liu +4

cs.DC2017

A Hierarchical Framework of Cloud Resource Allocation and Power Management Using Deep Reinforcement Learning

Ning Liu, Zhe Li, Zhiyuan Xu +5

cs.LG2019

DARB: A Density-Aware Regular-Block Pruning for Deep Neural Networks

Ao Ren, Tao Zhang, Yuhao Wang +5

cs.CR2022

A Secure and Efficient Federated Learning Framework for NLP

Jieren Deng, Chenghong Wang, Xianrui Meng +7

cs.DC2025

Malleus: Straggler-Resilient Hybrid Parallel Training of Large-scale Models via Malleable Data and Model Parallelization

Haoyang Li, Fangcheng Fu, Hao Ge +7

cs.AR2021

CAP-RAM: A Charge-Domain In-Memory Computing 6T-SRAM for Accurate and Precision-Programmable CNN Inference

Zhiyu Chen, Zhanghao Yu, Qing Jin +6

cs.NE2019

Progressive DNN Compression: A Key to Achieve Ultra-High Weight Pruning and Quantization Rates using ADMM

Shaokai Ye, Xiaoyu Feng, Tianyun Zhang +11

cs.LG2019

Toward Extremely Low Bit and Lossless Accuracy in DNNs with Progressive ADMM

Sheng Lin, Xiaolong Ma, Shaokai Ye +3

cs.AI2019

KCAT: A Knowledge-Constraint Typing Annotation Tool

Sheng Lin, Luye Zheng, Bo Chen +6

cs.DC2025

LobRA: Multi-tenant Fine-tuning over Heterogeneous Data

Sheng Lin, Fangcheng Fu, Haoyang Li +5

cs.DC2025

Hydraulis: Balancing Large Transformer Model Training via Co-designing Parallel Strategies and Data Assignment

Haoyang Li, Fangcheng Fu, Sheng Lin +8

hep-ph2025

Holographic Schwinger effect in flavor-dependent systems

Sheng Lin, Xuan Liu, Xun Chen +2

cs.LG2020

Non-Structured DNN Weight Pruning -- Is It Beneficial in Any Platform?

Xiaolong Ma, Sheng Lin, Shaokai Ye +10

cs.DC2026

Harnessing Routing Foresight for Micro-step-level MoE load balancing in RL Post-training

Yuming Zhou, Haoyang Li, Sheng Lin +6

cs.ET2019

An Ultra-Efficient Memristor-Based DNN Framework with Structured Weight Pruning and Quantization Using ADMM

Geng Yuan, Xiaolong Ma, Caiwen Ding +7

eess.SP2019

A SOT-MRAM-based Processing-In-Memory Engine for Highly Compressed DNN Implementation

Geng Yuan, Xiaolong Ma, Sheng Lin +2

cs.DC2026

Hetu v2: A General and Scalable Deep Learning System with Hierarchical and Heterogeneous Single Program Multiple Data Annotations

Haoyang Li, Fangcheng Fu, Hao Ge +6

cs.CV2020

An Image Enhancing Pattern-based Sparsity for Real-time Inference on Mobile Devices

Xiaolong Ma, Wei Niu, Tianyun Zhang +8

cs.LG2017

FFT-Based Deep Learning Deployment in Embedded Systems

Sheng Lin, Ning Liu, Mahdi Nazemi +4

cs.LG2019

ResNet Can Be Pruned 60x: Introducing Network Purification and Unused Path Removal (P-RM) after Weight Pruning

Xiaolong Ma, Geng Yuan, Sheng Lin +3

cs.CL2019

Learning Dynamic Context Augmentation for Global Entity Linking

Xiyuan Yang, Xiaotao Gu, Sheng Lin +6

cs.DC2026

StaleFlow: Staleness-Aware Data Management for Mitigating Data Skewness in Fully Disaggregated RL Post-Training

Haoyang Li, Sheng Lin, Fangcheng Fu +6

cs.LG2020

PatDNN: Achieving Real-Time DNN Execution on Mobile Devices with Pattern-based Weight Pruning

Wei Niu, Xiaolong Ma, Sheng Lin +5

hep-ph2026

The Interaction of Moving and QQq in the Thermal Plasma

Xuan Liu, Sheng Lin, Xun Chen

cs.SD2020

RTMobile: Beyond Real-Time Mobile Acceleration of RNNs for Speech Recognition

Peiyan Dong, Siyue Wang, Wei Niu +8