1 paper
Zhikang Xie, Xichen Ye, Yifan Wu +5
Diffusion models have revolutionized generative tasks but incur high latency due to iterative denoising. While cache-based strategies accelerate inference by reusing intermediate f…