1 paper
Yuexing Hao, Kumail Alhamoud, Hyewon Jeong +6
Large Language Models (LLMs) have demonstrated remarkable performance on various medical question-answering (QA) benchmarks, including standardized medical exams. However, correct…