3 papers
cs.AI2026
MAP-Law: Coverage-Driven Retrieval Control for Multi-Turn Legal Consultation
Qinchuan Cheng, Jiaqi Liu, Ruixuan Xie +2
Legal consultation is inherently iterative: before giving advice, a system must identify relevant legal elements, gather missing facts and authorities, and determine whether the cu…
cs.AI2026
RISER: Orchestrating Latent Reasoning Skills for Adaptive Activation Steering
Wencheng Ye, Xiaoyang Yuan, Yi Bin +4
Recent work on domain-specific reasoning with large language models (LLMs) often relies on training-intensive approaches that require parameter updates. While activation steering h…
cs.CL2025
More Than One Teacher: Adaptive Multi-Guidance Policy Optimization for Diverse Exploration
Xiaoyang Yuan, Yujuan Ding, Yi Bin +5
Reinforcement Learning with Verifiable Rewards (RLVR) is a promising paradigm for enhancing the reasoning ability in Large Language Models (LLMs). However, prevailing methods prima…