1 paper
Ning Wang, Kuanyan Zhu, Daniel Yuehwoon Yee +4
Retrieval-augmented generation (RAG) is now standard for knowledge-intensive LLM tasks, but most systems still treat every query as fresh, repeatedly re-retrieving long passages an…