2 papers
cs.CV2026
OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers
Donghyun Lee, Jitesh Chavan, Duy Nguyen +5
Diffusion transformers (DiTs) achieve state-of-the-art image and video generation, but their multi-step sampling and growing parameter count make inference expensive. Post-training…
cs.CV2025
Arcee: Differentiable Recurrent State Chain for Generative Vision Modeling with Mamba SSMs
Jitesh Chavan, Rohit Lal, Anand Kamat +1
State-space models (SSMs), Mamba in particular, are increasingly adopted for long-context sequence modeling, providing linear-time aggregation via an input-dependent, causal select…