2 papers
cs.NE2026
Lapis: Laplacian Spiking Attention via First-Spike Timing and Membrane Leakage
Kaiwen Tang, Jiaqi Zheng, Zixuan Zhu +3
Self-attention has become central to spiking vision transformers, yet its query-key scoring is still largely inherited from dense networks. Existing spiking variants either simplif…
cs.LG2026
Matterhorn: Masked Time-to-First-Spike Encoding by Reassigning the Silent State for Sparse and Energy-Efficient Spiking Transformers
Zhanglu Yan, Kaiwen Tang, Zixuan Zhu +4
Spiking neural networks (SNNs) promise energy-efficient inference for large language models (LLMs), yet most reported savings rely on compute-operation counts that overlook data mo…