2 papers
cs.CV2026
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
Rundong Su, Jintao Zhang, Zhihang Yuan +3
Diffusion transformers have demonstrated remarkable capabilities in generating videos. However, their practical deployment is severely constrained by high memory usage and computat…
cs.CV2025
DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers
Hanling Zhang, Rundong Su, Zhihang Yuan +5
Text-to-image generation models, especially Multimodal Diffusion Transformers (MMDiT), have shown remarkable progress in generating high-quality images. However, these models often…