3 papers
cs.AI2026
From Local Mismatch to Global Impact: Optimizing Cache Reuse Policy for Efficient Diffusion
Xichen Ye, Yifan Wu, Zhikang Xie +3
Diffusion models have achieved dominant performance in visual generation but suffer from substantial inference overhead. While cache-based acceleration has emerged as a promising s…
cs.LG2026
OnlineCache: Learning Dynamic Caching Policies with Error Correction for Efficient Diffusion Inference
Zhikang Xie, Xichen Ye, Yifan Wu +5
Diffusion models have revolutionized generative tasks but incur high latency due to iterative denoising. While cache-based strategies accelerate inference by reusing intermediate f…
cs.AI2025
Advanced Black-Box Tuning of Large Language Models with Limited API Calls
Zhikang Xie, Weilin Wan, Peizhu Gong +2
Black-box tuning is an emerging paradigm for adapting large language models (LLMs) to better achieve desired behaviors, particularly when direct access to model parameters is unava…