Showing cs.ARShow all
2 papers · 1 filter
cs.AR2025
FADiff: Fusion-Aware Differentiable Optimization for DNN Scheduling on Tensor Accelerators
Shuao Jia, Zichao Ling, Chen Bai +2
Efficient deployment of Deep Neural Networks (DNNs), such as Large Language Models (LLMs), on tensor accelerators is essential for maximizing computational efficiency in modern AI…
cs.AR2023
SoC-Tuner: An Importance-guided Exploration Framework for DNN-targeting SoC Design
Shixin Chen, Su Zheng, Chen Bai +4
Designing a system-on-chip (SoC) for deep neural network (DNN) acceleration requires balancing multiple metrics such as latency, power, and area. However, most existing methods ign…