4 papers
Defeat the Heap: Zero-Copy Data Movement in AXI4MLIR
Elam Cohavi, Nicolas Bohm Agostini, Jude Haris +3
As custom hardware accelerators become increasingly central to machine learning workloads, efficient data transfer is critical for maximizing accelerator performance on linear alge…
Towards Autonomous Accelerator Design: FPGA Accelerator Generation with SECDA
Vinamra Sharma, Xingjian Fu, Jude Haris +1
Designing FPGA-based accelerators for modern artificial intelligence workloads requires exploring a large and complex hardware design space that involves architectural parameters,…
LLM-Driven Design Space Exploration of FPGA-based Accelerators
Vinamra Sharma, Xingjian Fu, Jude Haris +1
Designing field-programmable gate array (FPGA)-based accelerators for modern artificial intelligence workloads requires navigating a large and complex hardware design space encompa…
Biases in Edge Language Models: Detection, Analysis, and Mitigation
Vinamra Sharma, Danilo Pietro Pau, José Cano
The integration of large language models (LLMs) on low-power edge devices such as Raspberry Pi, known as edge language models (ELMs), has introduced opportunities for more personal…