9 papers
Language Models Reproduce Human Reductionist Bias and Decision Inconsistency in Neurodevelopmental Disorders Assessment
Maciej Wodziński, Joanna Wodzińska, Kacper Dudzic +1
Large language models (LLMs) are increasingly supporting complex mental-health decisions, which depend not only on factual evidence but also value-laden interpretations. We introdu…
How LLMs Respond to Escalating Delusions: Four Longitudinal Trajectories of Model Behavior
Anna Sterna, Kacper Dudzic, Karolina Drożdż +3
The widespread use of LLMs among psychiatric populations has raised concerns regarding their safety and potential iatrogenic impact in the context of AI psychosis. While growing li…
Lost in Historical Time? A Polish History Matura Benchmark for Large Language Models
Adrian Trzoss, Kacper Dudzic, Wiktor Werner +1
Language models are widely used by students as knowledge sources, yet benchmarks rarely assess their interpretative historical reasoning. We evaluate eight leading LLMs on the Poli…
The Two-Process Theory of Machine Self-Report
Hubert Plisiecki, Filip Chmielewski, Kacper Dudzic +3
Language models are increasingly asked to self-report, informing safety evaluations, public understanding, and model-welfare debates. Yet their reports are elicited with human ques…
Patterns vs. Patients: Evaluating LLMs against Mental Health Professionals on Personality Disorder Diagnosis through First-Person Narratives
Karolina Drożdż, Kacper Dudzic, Anna Sterna +1
Growing reliance on LLMs for psychiatric self-assessment raises questions about their ability to interpret qualitative patient narratives. This depth over breadth case study direct…
The Pinocchio Dimension: Phenomenality of Experience as the Primary Axis of LLM Psychometric Differences
Hubert Plisiecki, Sabina Siudaj, Kacper Dudzic +4
We administer 45 validated psychometric questionnaires to 50 large language models (LLMs) to identify the dimensions along which LLMs differ psychometrically. Using Supervised Sema…