2 papers
cs.CV2026
BeCARE: Budgeted Cache Refresh for Diffusion Transformer Acceleration
Yuhang Zhang, Junxiang Qiu, Huixia Ben +4
Training-free feature caching accelerates diffusion transformer (DiT) inference by reusing or forecasting intermediate features. However, fixed schedules make compute predictable b…
cs.CV2025
IDCNet: Guided Video Diffusion for Metric-Consistent RGBD Scene Generation with Precise Camera Control
Lijuan Liu, Wenfa Li, Dongbo Zhang +2
We present IDC-Net (Image-Depth Consistency Network), a novel framework designed to generate RGB-D video sequences under explicit camera trajectory control. Unlike approaches that…