2 papers
cs.AI2024
CPL: Critical Plan Step Learning Boosts LLM Generalization in Reasoning Tasks
Tianlong Wang, Junzhe Chen, Xueting Han +1
Post-training, particularly reinforcement learning (RL) using self-play-generated data, has become a new learning paradigm for large language models (LLMs). However, scaling RL to…
cs.LG2021
Adaptive Transfer Learning on Graph Neural Networks
Xueting Han, Zhenhuan Huang, Bang An +1
Graph neural networks (GNNs) is widely used to learn a powerful representation of graph-structured data. Recent work demonstrates that transferring knowledge from self-supervised t…