1 paper · 1 filter
Mohammadreza Chavoshi, Hari Trivedi, Janice Newsome +6
Large language models (LLMs) are increasingly used to generate labels from radiology reports to enable large-scale AI evaluation. However, label noise from LLMs can introduce bias…