15 citations · 49 across the 13 of their papers we have counts for
Showing cs.ARShow all
2 papers · 1 filter
cs.AR2024
GFormer: Accelerating Large Language Models with Optimized Transformers on Gaudi Processors
Chengming Zhang, Xinheng Ding, Baixi Sun +4
Heterogeneous hardware like Gaudi processor has been developed to enhance computations, especially matrix operations for Transformer-based large language models (LLMs) for generati…
cs.AR2022★ 1 cited
H-GCN: A Graph Convolutional Network Accelerator on Versal ACAP Architecture
Chengming Zhang, Tong Geng, Anqi Guo +4
Graph Neural Networks (GNNs) have drawn tremendous attention due to their unique capability to extend Machine Learning (ML) approaches to applications broadly-defined as having uns…