2 papers
cs.LG2025
Self-Guided Process Reward Optimization with Redefined Step-wise Advantage for Process Reinforcement Learning
Wu Fei, Hao Kong, Shuxian Liang +5
Process Reinforcement Learning~(PRL) has demonstrated considerable potential in enhancing the reasoning capabilities of Large Language Models~(LLMs). However, introducing additiona…
cs.AI2025
PPTAgent: Generating and Evaluating Presentations Beyond Text-to-Slides
Hao Zheng, Xinyan Guan, Hao Kong +7
Automatically generating presentations from documents is a challenging task that requires accommodating content quality, visual appeal, and structural coherence. Existing methods p…