1 paper
Jiaqing Zhang, Sandeep Elluri, Bhanu Cherukuvada +7
Multimodal large language models (LLMs) are increasingly explored as automated evaluators in clinical settings, yet their scoring behavior on ordinal clinical scales remains poorly…