47 citations
- Université Libre de BruxellesBE73 papers
- University of Maryland, College ParkUS70 papers
- Massachusetts Institute of TechnologyUS67 papers
- Sungkyunkwan UniversityKR67 papers
- UCLouvainBE67 papers
- University of PaduaIT66 papers
- University of California SystemUS65 papers
- Universität HamburgDE64 papers
- Université Paris-SaclayFR64 papers
- The Ohio State UniversityUS63 papers
- University of Naples Federico IIIT63 papers
- Cornell UniversityUS62 papers
Showing cs.LGShow all
3 papers · 1 filter
cs.LG2026★ 2 cited
The relationship between reasoning and performance in large language models--o3 (mini) thinks harder, not longer
Marthe Ballon, Andres Algaba, Vincent Ginis
Large language models have demonstrated remarkable progress in mathematical reasoning, leveraging chain-of-thought and reinforcement learning. However, many open questions remain r…
cs.LG2026
Hybrid-AIRL: Enhancing Inverse Reinforcement Learning with Supervised Expert Guidance
Bram Silue, Santiago Amaya-Corredor, Patrick Mannion +2
Adversarial Inverse Reinforcement Learning (AIRL) has shown promise in addressing the sparse reward problem in reinforcement learning (RL) by inferring dense reward functions from…
cs.LG2026★ 18 cited
Humanity's Last Exam
Long Phan, Alice Gatti, Ziwen Han +1144
Benchmarks are important tools for tracking the rapid advancements in large language model (LLM) capabilities. However, benchmarks are not keeping pace in difficulty: LLMs now achi…