3 papers
cs.RO2026
GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation
GigaWorld Team, Angyuan Ma, Boyuan Wang +24
Evaluating embodied robot foundation models remains a critical bottleneck; unlike large language models efficiently assessed via digital benchmarks, robotic policies require slow,…
cs.CV2026
Disco-LoRA: Disentangled Composition of Content, Style, and Motion for Multi-concept Video Customization
Xuancheng Xu, Gengyun Jia, Bing-Kun Bao
Video customization based on Text-to-Video (T2V) models aims to learn specific features from reference data to generate controllable videos. While significant strides have been mad…
cs.CV2025
SMRABooth: Subject and Motion Representation Alignment for Customized Video Generation
Xuancheng Xu, Yaning Li, Sisi You +1
Customized video generation aims to produce videos that faithfully preserve the subject's appearance from reference images while maintaining temporally consistent motion from refer…