1 paper · 1 filter
Meghal Dani, Muthu Jeyanthi Prakash, Filip Rosa +2
Large Language Models (LLMs) have been shown to encode clinical knowledge. Many evaluations, however, rely on structured question-answer benchmarks, overlooking critical challenges…