3 papers
cs.CL2026
FARCA: Fact-Aligned Reliability-Aware Credit Assignment for Reinforcement Learning with Factual Supervision
Qiming Xie, Wenjie Zheng, Xiangqing Shen +1
To reduce the hallucination risk caused by outcome-driven rewards in large language models trained through reinforcement learning with verifiable rewards, existing mitigation appro…
cs.CL2025
Explainable Multimodal Depression Recognition in Clinical Interviews via PHQ-Aligned Symptom Summarization
Wenjie Zheng, Qiming Xie, Zengzhi Wang +7
Recent advances in multimodal depression recognition for clinical interviews (MDRC) have demonstrated the potential of AI systems by integrating textual, acoustic, and facial cues.…
cs.CL2024
Ask Again, Then Fail: Large Language Models' Vacillations in Judgment
Qiming Xie, Zengzhi Wang, Yi Feng +1
We observe that current conversational language models often waver in their judgments when faced with follow-up questions, even if the original judgment was correct. This wavering…