Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
Think Before You Drive: World Model-Inspired Multimodal Grounding for Autonomous Vehicles
Haicheng Liao, Huanming Shen, Bonan Wang +8
Interpreting natural-language commands to localize target objects is critical for autonomous driving (AD). Existing visual grounding (VG) methods for autonomous vehicles (AVs) typi…
cs.CV2025
LILAC: Long-sequence Incremental Low-latency Arbitrary Motion Stylization via Streaming VAE-Diffusion with Causal Decoding
Peng Ren, Hai Yang
Generating long and stylized human motions in real time is critical for applications that demand continuous and responsive character control. Despite its importance, existing strea…