Publications (59)
PDNNet: PDN-Aware GNN-CNN Heterogeneous Network for Dynamic IR Drop Prediction
Yuxiang Zhao, Zhuomin Chai, Xun Jiang +3
Probabilistic Compute-in-Memory Design For Efficient Markov Chain Monte Carlo Sampling
Yihan Fu, Daijing Shi, Anjunyi Fan +4
HybridNet: Dual-Branch Fusion of Geometrical and Topological Views for VLSI Congestion Prediction
Yuxiang Zhao, Zhuomin Chai, Yibo Lin +2
Memory System Designed for Multiply-Accumulate (MAC) Engine Based on Stochastic Computing
Xinyue Zhang, Yuan Wang, Yawen Zhang +5
Understanding Hot Carrier Reliability in FinFET Technology from Trap-based Approach
Runsheng Wang, Zixuan Sun, Yue-Yang Liu +4
MORE-Stress: Model Order Reduction based Efficient Numerical Algorithm for Thermal Stress Simulation of TSV Arrays in 2.5D/3D IC
Tianxiang Zhu, Qipan Wang, Yibo Lin +2
ATSim3D: Towards Accurate Thermal Simulator for Heterogeneous 3D-IC Systems Considering Nonlinear Leakage and Conductivity
Qipan Wang, Tianxiang Zhu, Yibo Lin +2
HybriMoE: Hybrid CPU-GPU Scheduling and Cache Management for Efficient MoE Inference
Shuzhang Zhong, Yanfan Sun, Ling Liang +3
SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding
Linye Wei, Shuzhang Zhong, Songqiang Xu +3
ATSim3.5D: A Multiscale Thermal Simulator for 3.5D-IC Systems based on Nonlinear Multigrid Method
Qipan Wang, Tianxiang Zhu, Yibo Lin +2
LayoutCopilot: An LLM-powered Multi-agent Collaborative Framework for Interactive Analog Layout Design
Bingyang Liu, Haoyi Zhang, Xiaohan Gao +5
A Tale of Two Sides of Wafer: Physical Implementation and Block-Level PPA on Flip FET with Dual-sided Signals
Haoran Lu, Xun Jiang, Yanbang Chu +7
UniCAIM: A Unified CAM/CIM Architecture with Static-Dynamic KV Cache Pruning for Efficient Long-Context LLM Inference
Weikai Xu, Wenxuan Zeng, Qianqian Huang +2
New-Generation Design-Technology Co-Optimization (DTCO): Machine-Learning Assisted Modeling Framework
Zhe Zhang, Runsheng Wang, Cheng Chen +6
Regression-Oriented Knowledge Distillation for Lightweight Ship Orientation Angle Prediction with Optical Remote Sensing Images
Zhan Shi, Xin Ding, Peng Ding +3
Generating a Doppelganger Graph: Resembling but Distinct
Yuliang Ji, Ru Huang, Jie Chen +1
Design Optimization of Flip FET Standard Cells with Dual-sided Pins for Ultimate Scaling
Rui Gui, Haoran Lu, Jiacheng Sun +7
CoPriv: Network/Protocol Co-Optimization for Communication-Efficient Private Inference
Wenxuan Zeng, Meng Li, Haichuan Yang +3
Analog Circuit Applications based on Ambipolar Graphene/MoTe2 Vertical Transistors
Chen Pan, Yajun Fu, Jiaxin Wang +12
SCALES: Boost Binary Neural Network for Image Super-Resolution with Efficient Scalings
Renjie Wei, Zechun Liu, Yuchen Fan +3
DaSGD: Squeezing SGD Parallelization Performance in Distributed Training Using Delayed Averaging
Qinggang Zhou, Yawen Zhang, Pengcheng Li +4
BAND-2k: Banding Artifact Noticeable Database for Banding Detection and Quality Assessment
Zijian Chen, Wei Sun, Jun Jia +6
Efficient yet Accurate End-to-End SC Accelerator Design
Meng Li, Yixuan Hu, Tengyu Zhang +4
Overlay-aware Variation Study of Flip FET and Benchmark with CFET
Wanyue Peng, Haoran Lu, Jingru Jiang +5
Extremely-Fast, Energy-Efficient Massive MIMO Precoding with Analog RRAM Matrix Computing
Pushen Zuo, Zhong Sun, Ru Huang
From Flip FET to Flip 3D Integration (F3D): Maximizing the Scaling Potential of Wafer Both Sides Beyond Conventional 3D Integration
Heng Wu, Haoran Lu, Wanyue Peng +13
NASiC: 3D NAND-based CAM-Selected Multibit CIM Architecture for Efficient On-Device Mixture-of-Experts LLM Inference
Weikai Xu, Meng Li, Shuzhang Zhong +7
Reducing operator complexity in Algebraic Multigrid with Machine Learning Approaches
Ru Huang, Kai Chang, Huan He +2
Thermal Conductivity of Cubic Silicon Carbide Single Crystals Heavily Doped by Nitrogen
Zifeng Huang, Yunfan Yang, Da Sheng +7
CircuitNet: An Open-Source Dataset for Machine Learning Applications in Electronic Design Automation (EDA)
Zhuomin Chai, Yuxiang Zhao, Yibo Lin +3
Learning optimal multigrid smoothers via neural networks
Ru Huang, Ruipeng Li, Yuanzhe Xi
A Systematic Approach for Multi-objective Double-side Clock Tree Synthesis
Xun Jiang, Haoran Lu, Yuxuan Zhao +8
ReaLM: Reliable and Efficient Large Language Model Inference with Statistical Algorithm-Based Fault Tolerance
Tong Xie, Jiawang Zhao, Zishen Wan +5
Leveraging Compute-in-Memory for Efficient Generative Model Inference in TPUs
Zhantong Zhu, Hongou Li, Wenjie Ren +4
Falcon: Accelerating Homomorphically Encrypted Convolutions for Efficient Private Mobile Network Inference
Tianshi Xu, Meng Li, Runsheng Wang +1
Recall Before You Rank: Similarity-Guided Top-$K$ Reuse for Efficient Long-Context Attention
Wenshuai Yao, Wenyong Zhou, Hanyong Shao +5
The paper proposes ReTopK, a training‑free technique that speeds up dynamic top‑K sparse attention for long‑context language models by reusing supports from historically similar qu…
MPCViT: Searching for Accurate and Efficient MPC-Friendly Vision Transformer with Heterogeneous Attention
Wenxuan Zeng, Meng Li, Wenjie Xiong +5
The Dawn of AI-Native EDA: Opportunities and Challenges of Large Circuit Models
Lei Chen, Yiqi Chen, Zhufei Chu +36
MCUBERT: Memory-Efficient BERT Inference on Commodity Microcontrollers
Zebin Yang, Renze Chen, Taiqiang Wu +5
READ: Reliability-Enhanced Accelerator Dataflow Optimization using Critical Input Pattern Reduction
Zuodong Zhang, Renjie Wei, Meng Li +3
Self-Aligned Double Patterning Friendly Configuration for Standard Cell Library Considering Placement
Jhih-Rong Gao, Bei Yu, Ru Huang +1
Memory-aware Scheduling for Complex Wired Networks with Iterative Graph Optimization
Shuzhang Zhong, Meng Li, Yun Liang +2
The Exploration-Exploitation Dilemma Revisited: An Entropy Perspective
Renye Yan, Yaozhong Gan, You Wu +4
ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding
Shuzhang Zhong, Zebin Yang, Meng Li +3
ATMPlace: Analytical Thermo-Mechanical-Aware Placement Framework for 2.5D-IC
Qipan Wang, Tianxiang Zhu, Tianyu Jia +3
A Novel Energy-Efficient Salicide-Enhanced Tunnel Device Technology Based on 300mm Foundry Platform Towards AIoT Applications
Kaifeng Wang, Qianqian Huang, Yongqin Wu +16
FastQuery: Communication-efficient Embedding Table Query for Private LLM Inference
Chenqi Lin, Tianshi Xu, Zebin Yang +3
BlockAMC: Scalable In-Memory Analog Matrix Computing for Solving Linear Systems
Lunshuai Pan, Pushen Zuo, Yubiao Luo +2
LaMoSys3.5D: Enabling 3.5D-IC-Based Large Language Model Inference Serving Systems via Hardware/Software Co-Design
Qipan Wang, Zhe Zhang, Shuangchen Li +5
Post-Layout Simulation Driven Analog Circuit Sizing
Xiaohan Gao, Haoyi Zhang, Siyuan Ye +6
AdapMoE: Adaptive Sensitivity-based Expert Gating and Management for Efficient MoE Inference
Shuzhang Zhong, Ling Liang, Yuan Wang +3
EasyACIM: An End-to-End Automated Analog CIM with Synthesizable Architecture and Agile Design Space Exploration
Haoyi Zhang, Jiahao Song, Xiaohan Gao +4
AttentionLego: An Open-Source Building Block For Spatially-Scalable Large Language Model Accelerator With Processing-In-Memory Technology
Rongqing Cong, Wenyang He, Mingxuan Li +5
An Energy-Efficient Mixed-Signal Parallel Multiply-Accumulate (MAC) Engine Based on Stochastic Computing
Xinyue Zhang, Jiahao Song, Yuan Wang +4
GAIA: Rethinking Action Quality Assessment for AI-Generated Videos
Zijian Chen, Wei Sun, Yuan Tian +7
ASCEND: Accurate yet Efficient End-to-End Stochastic Computing Acceleration of Vision Transformer
Tong Xie, Yixuan Hu, Renjie Wei +4
A Parallel Bitstream Generator for Stochastic Computing
Yawen Zhang, Runsheng Wang, Xinyue Zhang +5
EdgeMM: Multi-Core CPU with Heterogeneous AI-Extension and Activation-aware Weight Pruning for Multimodal LLMs at Edge
Kangbo Bai, Le Ye, Ru Huang +1
FS-BAND: A Frequency-Sensitive Banding Detector
Zijian Chen, Wei Sun, Zicheng Zhang +5