Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
HISR: Hindsight Information Modulated Segmental Process Rewards For Multi-turn Agentic Reinforcement Learning
Zhicong Lu, Zichuan Lin, Wei Jia +7
While large language models excel in diverse domains, their performance on complex longhorizon agentic decision-making tasks remains limited. Most existing methods concentrate on d…
cs.LG2025
Dual-Center Graph Clustering with Neighbor Distribution
Enhao Cheng, Shoujia Zhang, Jianhua Yin +2
Graph clustering is crucial for unraveling intricate data structures, yet it presents significant challenges due to its unsupervised nature. Recently, goal-directed clustering tech…