3 papers
cs.CV2025
VideoMAR: Autoregressive Video Generatio with Continuous Tokens
Hu Yu, Biao Gong, Hangjie Yuan +5
Masked-based autoregressive models have demonstrated promising image generation capability in continuous space. However, their potential for video generation remains under-explored…
cs.CV2025
Ming-Lite-Uni: Advancements in Unified Architecture for Natural Multimodal Interaction
Inclusion AI, Biao Gong, Cheng Zou +14
We introduce Ming-Lite-Uni, an open-source multimodal framework featuring a newly designed unified visual generator and a native multimodal autoregressive model tailored for unifyi…
cs.CV2025
VL-UR: Vision-Language-guided Universal Restoration of Images Degraded by Adverse Weather Conditions
Ziyan Liu, Yuxu Lu, Huashan Yu +1
Image restoration is critical for improving the quality of degraded images, which is vital for applications like autonomous driving, security surveillance, and digital content enha…