2 papers
cs.AR2025
A 33.6-136.2 TOPS/W Nonlinear Analog Computing-In-Memory Macro for Multi-bit LSTM Accelerator in 65 nm CMOS
Junyi Yang, Xinyu Luo, Ye Ke +7
The energy efficiency of analog computing-in-memory (ACIM) accelerator for recurrent neural networks, particularly long short-term memory (LSTM) network, is limited by the high pro…
cs.AR2024
Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC
Shuai Dong, Junyi Yang, Xiaoqi Peng +5
Transformer model has gained prominence as a popular deep neural network architecture for neural language processing (NLP) and computer vision (CV) applications. However, the exten…