1 paper · 1 filter
Jiaqing Zhang, Sandeep Elluri, Bhanu Cherukuvada +7
Multimodal large language models (LLMs) are increasingly explored as automated evaluators in clinical settings, yet their scoring behavior on ordinal clinical scales remains poorly…