3 papers
cs.CL2026
StateTree: Enhancing Long-Term Dialogue Reasoning via Reinforcement Learning
Naen Xu, Wanqing Cui, Yibo Hu +5
Large language models deployed as personalized assistants must reason over long, evolving interaction histories. However, in long-term dialogue reasoning, relevant evidence is scat…
cs.IR2025
Attention Grounded Enhancement for Visual Document Retrieval
Wanqing Cui, Wei Huang, Yazhi Guo +4
Visual document retrieval requires understanding heterogeneous and multi-modal content to satisfy implicit information needs. Recent advances use screenshot-based document encoding…
cs.LG2025
LiveThinking: Enabling Real-Time Efficient Reasoning for AI-Powered Livestreaming via Reinforcement Learning
Yuhan Sun, Zhiwei Huang, Wanqing Cui +4
In AI-powered e-commerce livestreaming, digital avatars require real-time responses to drive engagement, a task for which high-latency Large Reasoning Models (LRMs) are ill-suited.…