Showing cs.AIShow all
3 papers · 1 filter
cs.AI2026
ClinicalMC: A Benchmark for Multi-Course Clinical Decision-Making with Large Language Models
Ruihui Hou, Siyi Zhu, Ziyue Huai +4
Large language models (LLMs) have been widely adopted in healthcare, yet they still encounter significant challenges in complex clinical decision-making scenarios. Existing benchma…
cs.AI2026
PlanE: Meta Planning of Data, Tuning, and Inference for Extractive-based LLMs
Jiacheng Wang, Weiyan Zhang, Guangya Yu
Enhancing the task-specific capabilities of Large Language Models (LLMs) primarily requires substantial instruction-tuning datasets. However, the sheer volume of such data imposes…
cs.AI2024
MSDiagnosis: A Benchmark for Evaluating Large Language Models in Multi-Step Clinical Diagnosis
Ruihui Hou, Shencheng Chen, Yongqi Fan +5
Clinical diagnosis is critical in medical practice, typically requiring a continuous and evolving process that includes primary diagnosis, differential diagnosis, and final diagnos…