Publications (33)
S2O: Early Stopping for Sparse Attention via Online Permutation
Yu Zhang, Songwei Liu, Chenqian Yan +4
Efficient Micro-Structured Weight Unification and Pruning for Neural Network Compression
Sheng Lin, Wei Jiang, Wei Wang +4
Deep Compressed Pneumonia Detection for Low-Power Embedded Devices
Hongjia Li, Sheng Lin, Ning Liu +2
FORMS: Fine-grained Polarized ReRAM-based In-situ Computation for Mixed-signal DNN Accelerator
Geng Yuan, Payman Behnam, Zhengang Li +8
Towards Zero Memory Footprint Spiking Neural Network Training
Bin Lei, Sheng Lin, Pei-Hung Lin +2
Learning Topics using Semantic Locality
Ziyi Zhao, Krittaphat Pugdeethosapol, Sheng Lin +4
ESMFL: Efficient and Secure Models for Federated Learning
Sheng Lin, Chenghong Wang, Hongjia Li +3
Tiny but Accurate: A Pruned, Quantized and Optimized Memristor Crossbar Framework for Ultra Efficient DNN Implementation
Xiaolong Ma, Geng Yuan, Sheng Lin +6
FAIVConf: Face enhancement for AI-based Video Conference with Low Bit-rate
Zhengang Li, Sheng Lin, Shan Liu +4
A Hierarchical Framework of Cloud Resource Allocation and Power Management Using Deep Reinforcement Learning
Ning Liu, Zhe Li, Zhiyuan Xu +5
DARB: A Density-Aware Regular-Block Pruning for Deep Neural Networks
Ao Ren, Tao Zhang, Yuhao Wang +5
A Secure and Efficient Federated Learning Framework for NLP
Jieren Deng, Chenghong Wang, Xianrui Meng +7
Malleus: Straggler-Resilient Hybrid Parallel Training of Large-scale Models via Malleable Data and Model Parallelization
Haoyang Li, Fangcheng Fu, Hao Ge +7
CAP-RAM: A Charge-Domain In-Memory Computing 6T-SRAM for Accurate and Precision-Programmable CNN Inference
Zhiyu Chen, Zhanghao Yu, Qing Jin +6
Progressive DNN Compression: A Key to Achieve Ultra-High Weight Pruning and Quantization Rates using ADMM
Shaokai Ye, Xiaoyu Feng, Tianyun Zhang +11
Toward Extremely Low Bit and Lossless Accuracy in DNNs with Progressive ADMM
Sheng Lin, Xiaolong Ma, Shaokai Ye +3
KCAT: A Knowledge-Constraint Typing Annotation Tool
Sheng Lin, Luye Zheng, Bo Chen +6
LobRA: Multi-tenant Fine-tuning over Heterogeneous Data
Sheng Lin, Fangcheng Fu, Haoyang Li +5
Hydraulis: Balancing Large Transformer Model Training via Co-designing Parallel Strategies and Data Assignment
Haoyang Li, Fangcheng Fu, Sheng Lin +8
Holographic Schwinger effect in flavor-dependent systems
Sheng Lin, Xuan Liu, Xun Chen +2
Non-Structured DNN Weight Pruning -- Is It Beneficial in Any Platform?
Xiaolong Ma, Sheng Lin, Shaokai Ye +10
Harnessing Routing Foresight for Micro-step-level MoE load balancing in RL Post-training
Yuming Zhou, Haoyang Li, Sheng Lin +6
An Ultra-Efficient Memristor-Based DNN Framework with Structured Weight Pruning and Quantization Using ADMM
Geng Yuan, Xiaolong Ma, Caiwen Ding +7
A SOT-MRAM-based Processing-In-Memory Engine for Highly Compressed DNN Implementation
Geng Yuan, Xiaolong Ma, Sheng Lin +2
Hetu v2: A General and Scalable Deep Learning System with Hierarchical and Heterogeneous Single Program Multiple Data Annotations
Haoyang Li, Fangcheng Fu, Hao Ge +6
An Image Enhancing Pattern-based Sparsity for Real-time Inference on Mobile Devices
Xiaolong Ma, Wei Niu, Tianyun Zhang +8
FFT-Based Deep Learning Deployment in Embedded Systems
Sheng Lin, Ning Liu, Mahdi Nazemi +4
ResNet Can Be Pruned 60x: Introducing Network Purification and Unused Path Removal (P-RM) after Weight Pruning
Xiaolong Ma, Geng Yuan, Sheng Lin +3
Learning Dynamic Context Augmentation for Global Entity Linking
Xiyuan Yang, Xiaotao Gu, Sheng Lin +6
StaleFlow: Staleness-Aware Data Management for Mitigating Data Skewness in Fully Disaggregated RL Post-Training
Haoyang Li, Sheng Lin, Fangcheng Fu +6
PatDNN: Achieving Real-Time DNN Execution on Mobile Devices with Pattern-based Weight Pruning
Wei Niu, Xiaolong Ma, Sheng Lin +5
The Interaction of Moving and QQq in the Thermal Plasma
Xuan Liu, Sheng Lin, Xun Chen
RTMobile: Beyond Real-Time Mobile Acceleration of RNNs for Speech Recognition
Peiyan Dong, Siyue Wang, Wei Niu +8