NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (59)

cs.LG2024

PDNNet: PDN-Aware GNN-CNN Heterogeneous Network for Dynamic IR Drop Prediction

Yuxiang Zhao, Zhuomin Chai, Xun Jiang +3

cs.AR2023

Probabilistic Compute-in-Memory Design For Efficient Markov Chain Monte Carlo Sampling

Yihan Fu, Daijing Shi, Anjunyi Fan +4

cs.LG2023

HybridNet: Dual-Branch Fusion of Geometrical and Topological Views for VLSI Congestion Prediction

Yuxiang Zhao, Zhuomin Chai, Yibo Lin +2

eess.SP2019

Memory System Designed for Multiply-Accumulate (MAC) Engine Based on Stochastic Computing

Xinyue Zhang, Yuan Wang, Yawen Zhang +5

cond-mat.mes-hall2021

Understanding Hot Carrier Reliability in FinFET Technology from Trap-based Approach

Runsheng Wang, Zixuan Sun, Yue-Yang Liu +4

cs.CE2024

MORE-Stress: Model Order Reduction based Efficient Numerical Algorithm for Thermal Stress Simulation of TSV Arrays in 2.5D/3D IC

Tianxiang Zhu, Qipan Wang, Yibo Lin +2

physics.app-ph2026

ATSim3D: Towards Accurate Thermal Simulator for Heterogeneous 3D-IC Systems Considering Nonlinear Leakage and Conductivity

Qipan Wang, Tianxiang Zhu, Yibo Lin +2

cs.LG2025

HybriMoE: Hybrid CPU-GPU Scheduling and Cache Management for Efficient MoE Inference

Shuzhang Zhong, Yanfan Sun, Ling Liang +3

eess.AS2025

SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding

Linye Wei, Shuzhang Zhong, Songqiang Xu +3

physics.app-ph2026

ATSim3.5D: A Multiscale Thermal Simulator for 3.5D-IC Systems based on Nonlinear Multigrid Method

Qipan Wang, Tianxiang Zhu, Yibo Lin +2

cs.AR2025

LayoutCopilot: An LLM-powered Multi-agent Collaborative Framework for Interactive Analog Layout Design

Bingyang Liu, Haoyi Zhang, Xiaohan Gao +5

physics.app-ph2025

A Tale of Two Sides of Wafer: Physical Implementation and Block-Level PPA on Flip FET with Dual-sided Signals

Haoran Lu, Xun Jiang, Yanbang Chu +7

cs.AR2025

UniCAIM: A Unified CAM/CIM Architecture with Static-Dynamic KV Cache Pruning for Efficient Long-Context LLM Inference

Weikai Xu, Wenxuan Zeng, Qianqian Huang +2

cs.OH2019

New-Generation Design-Technology Co-Optimization (DTCO): Machine-Learning Assisted Modeling Framework

Zhe Zhang, Runsheng Wang, Cheng Chen +6

cs.CV2023

Regression-Oriented Knowledge Distillation for Lightweight Ship Orientation Angle Prediction with Optical Remote Sensing Images

Zhan Shi, Xin Ding, Peng Ding +3

cs.LG2021

Generating a Doppelganger Graph: Resembling but Distinct

Yuliang Ji, Ru Huang, Jie Chen +1

cond-mat.mes-hall2025

Design Optimization of Flip FET Standard Cells with Dual-sided Pins for Ultimate Scaling

Rui Gui, Haoran Lu, Jiacheng Sun +7

cs.CR2023

CoPriv: Network/Protocol Co-Optimization for Communication-Efficient Private Inference

Wenxuan Zeng, Meng Li, Haichuan Yang +3

cond-mat.mes-hall2018

Analog Circuit Applications based on Ambipolar Graphene/MoTe2 Vertical Transistors

Chen Pan, Yajun Fu, Jiaxin Wang +12

cs.CV2025

SCALES: Boost Binary Neural Network for Image Super-Resolution with Efficient Scalings

Renjie Wei, Zechun Liu, Yuchen Fan +3

cs.DC2020

DaSGD: Squeezing SGD Parallelization Performance in Distributed Training Using Delayed Averaging

Qinggang Zhou, Yawen Zhang, Pengcheng Li +4

cs.CV2023

BAND-2k: Banding Artifact Noticeable Database for Banding Detection and Quality Assessment

Zijian Chen, Wei Sun, Jun Jia +6

cs.AR2024

Efficient yet Accurate End-to-End SC Accelerator Design

Meng Li, Yixuan Hu, Tengyu Zhang +4

cond-mat.mes-hall2025

Overlay-aware Variation Study of Flip FET and Benchmark with CFET

Wanyue Peng, Haoran Lu, Jingru Jiang +5

eess.SP2022

Extremely-Fast, Energy-Efficient Massive MIMO Precoding with Analog RRAM Matrix Computing

Pushen Zuo, Zhong Sun, Ru Huang

cond-mat.mes-hall2024

From Flip FET to Flip 3D Integration (F3D): Maximizing the Scaling Potential of Wafer Both Sides Beyond Conventional 3D Integration

Heng Wu, Haoran Lu, Wanyue Peng +13

cs.AR2026

NASiC: 3D NAND-based CAM-Selected Multibit CIM Architecture for Efficient On-Device Mixture-of-Experts LLM Inference

Weikai Xu, Meng Li, Shuzhang Zhong +7

math.NA2023

Reducing operator complexity in Algebraic Multigrid with Machine Learning Approaches

Ru Huang, Kai Chang, Huan He +2

cond-mat.mtrl-sci2024

Thermal Conductivity of Cubic Silicon Carbide Single Crystals Heavily Doped by Nitrogen

Zifeng Huang, Yunfan Yang, Da Sheng +7

cs.LG2022

CircuitNet: An Open-Source Dataset for Machine Learning Applications in Electronic Design Automation (EDA)

Zhuomin Chai, Yuxiang Zhao, Yibo Lin +3

math.NA2021

Learning optimal multigrid smoothers via neural networks

Ru Huang, Ruipeng Li, Yuanzhe Xi

cs.AR2025

A Systematic Approach for Multi-objective Double-side Clock Tree Synthesis

Xun Jiang, Haoran Lu, Yuxuan Zhao +8

cs.AR2025

ReaLM: Reliable and Efficient Large Language Model Inference with Statistical Algorithm-Based Fault Tolerance

Tong Xie, Jiawang Zhao, Zishen Wan +5

cs.AR2025

Leveraging Compute-in-Memory for Efficient Generative Model Inference in TPUs

Zhantong Zhu, Hongou Li, Wenjie Ren +4

cs.CR2023

Falcon: Accelerating Homomorphically Encrypted Convolutions for Efficient Private Mobile Network Inference

Tianshi Xu, Meng Li, Runsheng Wang +1

cs.CL2026

Recall Before You Rank: Similarity-Guided Top-$K$ Reuse for Efficient Long-Context Attention

Wenshuai Yao, Wenyong Zhou, Hanyong Shao +5

The paper proposes ReTopK, a training‑free technique that speeds up dynamic top‑K sparse attention for long‑context language models by reusing supports from historically similar qu…

#sparse attention#long-context inference#top‑k selection#cache reuse
cs.CR2023

MPCViT: Searching for Accurate and Efficient MPC-Friendly Vision Transformer with Heterogeneous Attention

Wenxuan Zeng, Meng Li, Wenjie Xiong +5

cs.AR2024

The Dawn of AI-Native EDA: Opportunities and Challenges of Large Circuit Models

Lei Chen, Yiqi Chen, Zhufei Chu +36

cs.LG2024

MCUBERT: Memory-Efficient BERT Inference on Commodity Microcontrollers

Zebin Yang, Renze Chen, Taiqiang Wu +5

cs.AR2023

READ: Reliability-Enhanced Accelerator Dataflow Optimization using Critical Input Pattern Reduction

Zuodong Zhang, Renjie Wei, Meng Li +3

cs.AR2014

Self-Aligned Double Patterning Friendly Configuration for Standard Cell Library Considering Placement

Jhih-Rong Gao, Bei Yu, Ru Huang +1

cs.LG2023

Memory-aware Scheduling for Complex Wired Networks with Iterative Graph Optimization

Shuzhang Zhong, Meng Li, Yun Liang +2

cs.LG2024

The Exploration-Exploitation Dilemma Revisited: An Entropy Perspective

Renye Yan, Yaozhong Gan, You Wu +4

cs.LG2024

ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding

Shuzhang Zhong, Zebin Yang, Meng Li +3

math.NA2025

ATMPlace: Analytical Thermo-Mechanical-Aware Placement Framework for 2.5D-IC

Qipan Wang, Tianxiang Zhu, Tianyu Jia +3

cond-mat.mes-hall2024

A Novel Energy-Efficient Salicide-Enhanced Tunnel Device Technology Based on 300mm Foundry Platform Towards AIoT Applications

Kaifeng Wang, Qianqian Huang, Yongqin Wu +16

cs.CR2024

FastQuery: Communication-efficient Embedding Table Query for Private LLM Inference

Chenqi Lin, Tianshi Xu, Zebin Yang +3

cs.AR2024

BlockAMC: Scalable In-Memory Analog Matrix Computing for Solving Linear Systems

Lunshuai Pan, Pushen Zuo, Yubiao Luo +2

eess.SY2025

LaMoSys3.5D: Enabling 3.5D-IC-Based Large Language Model Inference Serving Systems via Hardware/Software Co-Design

Qipan Wang, Zhe Zhang, Shuangchen Li +5

cs.AR2023

Post-Layout Simulation Driven Analog Circuit Sizing

Xiaohan Gao, Haoyi Zhang, Siyuan Ye +6

cs.LG2024

AdapMoE: Adaptive Sensitivity-based Expert Gating and Management for Efficient MoE Inference

Shuzhang Zhong, Ling Liang, Yuan Wang +3

cs.AR2024

EasyACIM: An End-to-End Automated Analog CIM with Synthesizable Architecture and Agile Design Space Exploration

Haoyi Zhang, Jiahao Song, Xiaohan Gao +4

cs.AR2024

AttentionLego: An Open-Source Building Block For Spatially-Scalable Large Language Model Accelerator With Processing-In-Memory Technology

Rongqing Cong, Wenyang He, Mingxuan Li +5

eess.SP2019

An Energy-Efficient Mixed-Signal Parallel Multiply-Accumulate (MAC) Engine Based on Stochastic Computing

Xinyue Zhang, Jiahao Song, Yuan Wang +4

cs.CV2024

GAIA: Rethinking Action Quality Assessment for AI-Generated Videos

Zijian Chen, Wei Sun, Yuan Tian +7

eess.SY2024

ASCEND: Accurate yet Efficient End-to-End Stochastic Computing Acceleration of Vision Transformer

Tong Xie, Yixuan Hu, Renjie Wei +4

cs.ET2019

A Parallel Bitstream Generator for Stochastic Computing

Yawen Zhang, Runsheng Wang, Xinyue Zhang +5

cs.AR2025

EdgeMM: Multi-Core CPU with Heterogeneous AI-Extension and Activation-aware Weight Pruning for Multimodal LLMs at Edge

Kangbo Bai, Le Ye, Ru Huang +1

cs.CV2023

FS-BAND: A Frequency-Sensitive Banding Detector

Zijian Chen, Wei Sun, Zicheng Zhang +5