2 papers
cs.LG2024
TidalDecode: Fast and Accurate LLM Decoding with Position Persistent Sparse Attention
Lijie Yang, Zhihao Zhang, Zhuofu Chen +2
Large language models (LLMs) have driven significant advancements across diverse NLP tasks, with long-context models gaining prominence for handling extended inputs. However, the e…
cs.PL2022
Quartz: Superoptimization of Quantum Circuits (Extended Version)
Mingkuan Xu, Zikun Li, Oded Padon +8
Existing quantum compilers optimize quantum circuits by applying circuit transformations designed by experts. This approach requires significant manual effort to design and impleme…