2 papers
cs.AR2026
Salca: A Sparsity-Aware Hardware Accelerator for Efficient Long-Context Attention Decoding
Wang Fan, Wei Cao, Xi Zha +5
Long contexts improve capabilities of large language models but pose serious hardware challenges: compute and memory footprints grow linearly with sequence length. Particularly, th…
quant-ph2024
Qubit-Wise Architecture Search Method for Variational Quantum Circuits
Jialin Chen, Zhiqiang Cai, Ke Xu +2
Considering the noise level limit, one crucial aspect for quantum machine learning is to design a high-performing variational quantum circuit architecture with small number of quan…