2 papers
cs.AI2026
From "Weak" Signals to Strong Models: Preference Delta Aggregation with LoRA Merging
Qi Sun, Siyue Zhang, Yulin Chen +3
Training strong large language models (LLMs) requires high-quality supervision, which is often scarce. Recent work shows that paired preference data from weak-weaker model pairs (e…
cs.CL2025
MRAG: A Modular Retrieval Framework for Time-Sensitive Question Answering
Zhang Siyue, Xue Yuxiang, Zhang Yiming +3
Understanding temporal relations and answering time-sensitive questions is crucial yet a challenging task for question-answering systems powered by large language models (LLMs). Ex…