3 papers
cs.LG2026
Controllable Flow Matching for Online Reinforcement Learning
Bin Wang, Boxiang Tao, Haifeng Jing +2
Model-based reinforcement learning (MBRL) typically relies on modeling environment dynamics for data efficiency. However, due to the accumulation of model errors over long-horizon…
cs.LG2025
Learn A Flexible Exploration Model for Parameterized Action Markov Decision Processes
Zijian Wang, Bin Wang, Mingwen Shao +2
Hybrid action models are widely considered an effective approach to reinforcement learning (RL) modeling. The current mainstream method is to train agents under Parameterized Actio…
cs.AI2024
Walk Wisely on Graph: Knowledge Graph Reasoning with Dual Agents via Efficient Guidance-Exploration
Zijian Wang, Bin Wang, Haifeng Jing +2
Recent years, multi-hop reasoning has been widely studied for knowledge graph (KG) reasoning due to its efficacy and interpretability. However, previous multi-hop reasoning approac…