Showing cs.IRShow all
2 papers · 1 filter
cs.IR2026
HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research
Yubo Sun, Chunyi Peng, Yukun Yan +6
Deep research requires models to retrieve, connect, and synthesize evidence from large-scale heterogeneous sources to answer complex queries and produce analytical reports. Existin…
cs.IR2026
Memory Shot for Long-Term Dialogue
Chunyi Peng, Haidong Xin, Xuanshuo Sheng +7
Large Language Models (LLMs) have demonstrated strong capabilities in general conversation, instruction following, and complex reasoning. However, in long-term dialogue settings, t…