activity
20242026
collaborators

11 papers

cs.LG2026

BRICKS-WM: Building Reusability via Interface Composition Kinetics for Structured World Models

Shaowei Zhang, Jiahan Cao, Xunlan Zhou +2

Model-based Reinforcement Learning (MBRL) has achieved remarkable success in continuous control by leveraging latent world models. However, prevailing approaches typically rely on…

cs.LG2026

DyDiff: Long-Horizon Rollout via Dynamics Diffusion for Offline Reinforcement Learning

Hanye Zhao, Xiaoshen Han, Zhengbang Zhu +4

With the great success of diffusion models (DMs) in generating realistic synthetic vision data, many researchers have investigated their potential in decision-making and control. M…

cs.RO2026

MARVL: Multi-Stage Guidance for Robotic Manipulation via Vision-Language Models

Xunlan Zhou, Xuanlin Chen, Shaowei Zhang +4

Designing dense reward functions is pivotal for efficient robotic Reinforcement Learning (RL). However, most dense rewards rely on manual engineering, which fundamentally limits th…

cs.LG2026

Co-Evolving Latent Action World Models

Yucen Wang, Fengming Zhang, De-Chuan Zhan +3

Adapting pretrained video generation models into controllable world models via latent actions is a promising step towards creating generalist world models. The dominant paradigm ad…

cs.CL2025

DART: Distilling Autoregressive Reasoning to Silent Thought

Nan Jiang, Ziming Wu, De-Chuan Zhan +2

Chain-of-Thought (CoT) reasoning has significantly advanced Large Language Models (LLMs) in solving complex tasks. However, its autoregressive paradigm leads to significant computa…

cs.RO2025

FOUNDER: Grounding Foundation Models in World Models for Open-Ended Embodied Decision Making

Yucen Wang, Rui Yu, Shenghua Wan +2

Foundation Models (FMs) and World Models (WMs) offer complementary strengths in task generalization at different levels. In this work, we propose FOUNDER, a framework that integrat…