1 paper · 1 filter
Agamdeep Singh, Srishti Gautam, Priyanshu Gupta +3
Reasoning modes of language models outperform their non-reasoning counterparts on multi-step agentic tasks, but pay a 3-6x premium in output tokens on every episode -- much of it s…