2 papers
cs.CV2026
BeCARE: Budgeted Cache Refresh for Diffusion Transformer Acceleration
Yuhang Zhang, Junxiang Qiu, Huixia Ben +4
Training-free feature caching accelerates diffusion transformer (DiT) inference by reusing or forecasting intermediate features. However, fixed schedules make compute predictable b…
cs.CV2024
Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers
Peng Gao, Le Zhuo, Dongyang Liu +17
Sora unveils the potential of scaling Diffusion Transformer for generating photorealistic images and videos at arbitrary resolutions, aspect ratios, and durations, yet it still lac…