collaborators

7 papers

cs.CL2026

Hint-Guided Diversified Policy Optimization for LLM Reasoning

Zhiyu Cao, Kaixin Wu, Mingjie Zhong +4

Recent developments in Large Language Models (LLMs) have showcased impressive reasoning capabilities, with Reinforcement Learning with Verifiable Rewards (RLVR) being a promising e…

cs.CL2026

Discourse Coherence and Response-Guided Context Rewriting for Multi-Party Dialogue Generation

Zhiyu Cao, Peifeng Li, Qiaoming Zhu

Previous research on multi-party dialogue generation has predominantly leveraged structural information inherent in dialogues to directly inform the generation process. However, th…

cs.CL2026

Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search

Zhiyu Cao, Peifeng Li, Qiaoming Zhu

Conversational Query Rewriting (CQR) aims to rewrite ambiguous queries to achieve more efficient conversational search. Early studies have predominantly focused on the rewriting in…

cs.IR2026

ReCQR: Incorporating conversational query rewriting to improve Multimodal Image Retrieval

Yuan Hu, ZhiYu Cao, PeiFeng Li +1

With the rise of multimodal learning, image retrieval plays a crucial role in connecting visual information with natural language queries. Existing image retrievers struggle with p…

cs.CL2025

ICR: Iterative Clarification and Rewriting for Conversational Search

Zhiyu Cao, Peifeng Li, Qiaoming Zhu

Most previous work on Conversational Query Rewriting employs an end-to-end rewriting paradigm. However, this approach is hindered by the issue of multiple fuzzy expressions within…

cs.CL2025

Two-stage Incomplete Utterance Rewriting on Editing Operation

Zhiyu Cao, Peifeng Li, Qiaoming Zhu +1

Previous work on Incomplete Utterance Rewriting (IUR) has primarily focused on generating rewritten utterances based solely on dialogue context, ignoring the widespread phenomenon…