Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Parallel Prefix Verification for Speculative Generation
Yuncheng Yao, Yuxuan Xia, Shengjie Wang +1
We introduce PARSE (PArallel pRefix Speculative Engine), a speculative generation framework that accelerates large language model (LLM) inference by parallelizing prefix verificati…
cs.AI2025
HilbertA: Hilbert Attention for Image Generation with Diffusion Models
Shaoyi Zheng, Wenbo Lu, Yuxuan Xia +2
Designing sparse attention for diffusion transformers requires reconciling two-dimensional spatial locality with GPU efficiency, a trade-off that current methods struggle to achiev…