Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
No Cache Left Idle: Accelerating diffusion model via Extreme-slimming Caching
Tingyan Wen, Haoyu Li, Yihuang Chen +3
Diffusion models achieve remarkable generative quality, but computational overhead scales with step count, model depth, and sequence length. Feature caching is effective since adja…
cs.CV2025
ConvRot: Rotation-Based Plug-and-Play 4-bit Quantization for Diffusion Transformers
Feice Huang, Zuliang Han, Xing Zhou +3
Diffusion transformers have demonstrated strong capabilities in generating high-quality images. However, as model size increases, the growing memory footprint and inference latency…