2 papers
cs.CV2026
Accelerating Video Diffusion via Training-Free Trajectory Routing
Mustafa Munir, Huy Vu, Shreyas Misra +7
Video diffusion is computationally expensive, as it requires executing a large model across many denoising steps. Even with step-distillation, inference remains expensive because e…
cs.CV2026
Cosmos 3: Omnimodal World Models for Physical AI
NVIDIA, :, Aditi +293
We introduce Cosmos 3, a family of omnimodal world models designed to jointly process and generate language, image, video, audio, and action sequences within a unified mixture-of-t…