7 papers
Hint-Guided Diversified Policy Optimization for LLM Reasoning
Zhiyu Cao, Kaixin Wu, Mingjie Zhong +4
Recent developments in Large Language Models (LLMs) have showcased impressive reasoning capabilities, with Reinforcement Learning with Verifiable Rewards (RLVR) being a promising e…
DraDDP: A Multimodal Multi-Party Dialogue Discourse Parsing Dataset
Shannan Liu, Peifeng Li, Yaxin Fan +1
Multi-party dialogue discourse parsing aims to identify dependency structures and relation types between utterances in conversations. Previous studies are mostly limited to textual…
Discourse Coherence and Response-Guided Context Rewriting for Multi-Party Dialogue Generation
Zhiyu Cao, Peifeng Li, Qiaoming Zhu
Previous research on multi-party dialogue generation has predominantly leveraged structural information inherent in dialogues to directly inform the generation process. However, th…
Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search
Zhiyu Cao, Peifeng Li, Qiaoming Zhu
Conversational Query Rewriting (CQR) aims to rewrite ambiguous queries to achieve more efficient conversational search. Early studies have predominantly focused on the rewriting in…
ReCQR: Incorporating conversational query rewriting to improve Multimodal Image Retrieval
Yuan Hu, ZhiYu Cao, PeiFeng Li +1
With the rise of multimodal learning, image retrieval plays a crucial role in connecting visual information with natural language queries. Existing image retrievers struggle with p…
ICR: Iterative Clarification and Rewriting for Conversational Search
Zhiyu Cao, Peifeng Li, Qiaoming Zhu
Most previous work on Conversational Query Rewriting employs an end-to-end rewriting paradigm. However, this approach is hindered by the issue of multiple fuzzy expressions within…