Showing cs.ARShow all
2 papers · 1 filter
cs.AR2026
SISA: A Scale-In Systolic Array for GEMM Acceleration
Luigi Altamura, Alessio Cicero, Mateo Vázquez Maceiras +3
The currently dominant AI/ML workloads, such as Large Language Models (LLMs), rely on the efficient execution of General Matrix-Matrix Multiplication (GEMM) operations. Thus, most…
cs.AR2025
An Analytical Cost Model for Fast Evaluation of Multiple Compute-Engine CNN Accelerators
Fareed Qararyah, Mohammad Ali Maleki, Pedro Trancoso
Convolutional Neural Networks (CNNs) serve various applications with diverse performance and resource requirements. Model-aware CNN accelerators best address these diverse requirem…