3 papers
cs.LG2025
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
Wenhao Deng, Long Wei, Chenglei Yu +1
Reinforcement learning with verifiable rewards (RLVR) has recently enhanced the reasoning capabilities of large language models (LLMs), particularly for mathematical problem solvin…
cs.LG2025
FLDmamba: Integrating Fourier and Laplace Transform Decomposition with Mamba for Enhanced Time Series Prediction
Qianru Zhang, Chenglei Yu, Haixin Wang +5
Time series prediction, a crucial task across various domains, faces significant challenges due to the inherent complexities of time series data, including non-stationarity, multi-…
cs.LG2025
On the Guidance of Flow Matching
Ruiqi Feng, Chenglei Yu, Wenhao Deng +2
Flow matching has shown state-of-the-art performance in various generative tasks, ranging from image generation to decision-making, where generation under energy guidance (abbrevia…