1 paper
Maksim Sheverev, David Finkelstein, Sergey Nikolenko
Long-term memory is becoming a core component of LLM agents, but most memory benchmarks evaluate conversations or compact summaries, while research agents need to restore evidence…