1 paper
Roy Jiang, Hyunjae Kim, Zhenyue Qin +8
Multimodal large language models (MLLMs) have demonstrated promise on publicly available dermatology benchmarks. However, benchmark performance may not generalize to real-world der…