1 paper · 1 filter
Haoyue Tan, Shengnan Wang, Yulin Qiao +5
Video diffusion transformers (DiTs) suffer from prohibitive inference latency due to quadratic attention complexity. Existing sparse attention methods either overlook semantic simi…