2 papers
cs.CL2026
Harmony in Diversity: Multi-domain Contrastive Policy Optimization for Large Reasoning Models
Zongji Yu, Wenshui Luo, Yiliu Sun +4
Post-training has significantly enhanced the reasoning capability of Large Reasoning Models (LRMs), especially with Reinforcement Learning (RL) like Group Relative Policy Optimizat…
cs.LG2026
Delving into Non-Exchangeability for Conformal Prediction in Graph-Structured Multivariate Time Series
Ruichao Guo, Xingyao Han, Luo Wenshui +3
Point forecasting for graph-structured multivariate time series is a fundamental problem, but rigorous uncertainty quantification for such predictions is still underexplored. Confo…