2 papers
cs.LG2025
Self-Questioning Language Models
Lili Chen, Mihir Prabhudesai, Katerina Fragkiadaki +2
Can large language models improve without external data -- by generating their own questions and answers? We hypothesize that a pre-trained language model can improve its reasoning…
cs.LG2025
Maximizing Confidence Alone Improves Reasoning
Mihir Prabhudesai, Lili Chen, Alex Ippoliti +3
Reinforcement learning (RL) has enabled machine learning models to achieve significant advances in many fields. Most recently, RL has empowered frontier language models to solve ch…