2 papers
cs.AR2026
Decoupling Logical Masks from GPU Execution for Dynamic Block-Sparse Attention
Shanghao Liu, Xiaoyun Yu, Wanting Li +1
Attention computation makes inference expensive in video diffusion transformers (vDiTs), which generate videos through iterative denoising. Block-sparse attention (BSA) reduces thi…
cs.LG2026
MUSE: Dependency-Aware Adaptation of a Frozen Vision Backbone for Multivariate Time Series Forecasting
Xinying Cai, Junkai Lu, Yuhan Zhu +3
Multivariate time-series forecasting is essential to many real-world applications. Recent large vision models (LVMs) offer a promising paradigm by transferring cross-domain visual…