2 papers
cs.CV2026
BindWeave: Subject-Consistent Video Generation via Cross-Modal Integration
Zhaoyang Li, Dongjun Qian, Kai Su +6
Diffusion Transformer has shown remarkable abilities in generating high-fidelity videos, delivering visually coherent frames and rich details over extended durations. However, exis…
cs.AI2025
LADY: Linear Attention for Autonomous Driving Efficiency without Transformers
Jihao Huang, Xi Xia, Zhiyuan Li +4
End-to-end autonomous driving has emerged as a promising paradigm. However, state-of-the-art methods rely heavily on Transformer architectures. The inherent quadratic complexity of…