4 papers
Baichuan-M4: A Clinical-Grade Medical Agent System for Continuous Care
Aiyuan Yang, Canbin Piao, Chengfeng Dou +25
Baichuan-M4 is Baichuan Intelligence's clinical-grade medical large model, designed for continuous care rather than single-turn medical question answering. It is built as a coordin…
Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making
M3 Team, Chengfeng Dou, Fan Yang +15
We introduce Baichuan-M3, a medical-enhanced large language model engineered to shift the paradigm from passive question-answering to active, clinical-grade decision support. Addre…
DCPO: Dynamic Clipping Policy Optimization
Shihui Yang, Chengfeng Dou, Peidong Guo +4
Reinforcement Learning from Verifiable Rewards (RLVR) has emerged as a promising framework for enhancing the reasoning capabilities of large language models. However, existing appr…
Baichuan-M2: Scaling Medical Capability with Large Verifier System
M2 Team, Chengfeng Dou, Chong Liu +31
As large language models (LLMs) advance in conversational and reasoning capabilities, their practical application in healthcare has become a critical research focus. However, there…