2 papers
cs.CL2025
Convomem Benchmark: Why Your First 150 Conversations Don't Need RAG
Egor Pakhomov, Erik Nijkamp, Caiming Xiong
We introduce a comprehensive benchmark for conversational memory evaluation containing 75,336 question-answer pairs across diverse categories including user facts, assistant recall…
cs.CL2025
A Survey on Post-training of Large Language Models
Guiyao Tie, Zeli Zhao, Dingjie Song +23
The emergence of Large Language Models (LLMs) has fundamentally transformed natural language processing, making them indispensable across domains ranging from conversational system…