3 papers
cs.RO2025
Stochastic Trajectory Prediction under Unstructured Constraints
Hao Ma, Zhiqiang Pu, Shijie Wang +4
Trajectory prediction facilitates effective planning and decision-making, while constrained trajectory prediction integrates regulation into prediction. Recent advances in constrai…
cs.MA2025
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
Jinyuan Feng, Min Chen, Zhiqiang Pu +2
To develop generalizable models in multi-agent reinforcement learning, recent approaches have been devoted to discovering task-independent skills for each agent, which generalize a…
cs.AI2025
Coevolving with the Other You: Fine-Tuning LLM with Sequential Cooperative Multi-Agent Reinforcement Learning
Hao Ma, Tianyi Hu, Zhiqiang Pu +4
Reinforcement learning (RL) has emerged as a pivotal technique for fine-tuning large language models (LLMs) on specific tasks. However, prevailing RL fine-tuning methods predominan…