Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
MSVIT: Improving Spiking Vision Transformer Using Multi-scale Attention Fusion
Wei Hua, Chenlin Zhou, Jibin Wu +2
The combination of Spiking Neural Networks (SNNs) with Vision Transformer architectures has garnered significant attention due to their potential for energy-efficient and high-perf…
cs.CV2024
SVFormer: A Direct Training Spiking Transformer for Efficient Video Action Recognition
Liutao Yu, Liwei Huang, Chenlin Zhou +4
Video action recognition (VAR) plays crucial roles in various domains such as surveillance, healthcare, and industrial automation, making it highly significant for the society. Con…