Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
Auditing medical multi-agent AI reveals risks of false consensus
Yinghao Zhu, Lei Gu, Zixiang Wang +11
Large language models are increasingly being assembled into medical multi-agent systems that emulate multidisciplinary consultation through specialist roles, peer review and consen…
cs.CL2025
ClinicRealm: Re-evaluating Large Language Models with Conventional Machine Learning for Non-Generative Clinical Prediction Tasks
Yinghao Zhu, Junyi Gao, Zixiang Wang +9
Large Language Models (LLMs) are increasingly deployed in medicine. However, their utility in non-generative clinical prediction, often presumed inferior to specialized models, rem…