2 papers
cs.AI2026
Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence
Jakub Pokrywka, Łukasz Grzybowski, Antoni Lasik +3
We introduce a Polish-language medical visual question answering (VQA) benchmark, built from Polish Board Certification Examination questions for licensed physicians and dentists p…
cs.CL2026
Reassessing High-Performing LLMs on Polish Medical Exams: True Competence or Bias-Driven Performance?
Antoni Lasik, Jakub Pokrywka, Åukasz Grzybowski +7
Large language models (LLMs) in medicine are mainly evaluated using multiple-choice question answering (MCQA), which can overestimate real clinical ability due to guessing strategi…