3 papers
cs.LG2026
Collapsibility of Performance Metrics in Clinical Predictive AI
João Matos, Ben Van Calster, Richard D. Riley +2
Background: Population level assessments of predictive artificial intelligence (AI) can conceal performance disparities across subgroups. Fairness evaluations commonly rely on perf…
stat.CO2026
Efficient Variance Estimation for the Polytomous Discrimination Index
Qunqiang Feng, Taozheng Jia, Pan Liu +2
Evaluating diagnostic accuracy for multi-category outcomes remains a significant challenge, primarily due to computational limitations in existing performance metrics. The Polytomo…
stat.AP2026
Value-of-Information Analysis for External Validation of Risk Prediction Models in Multicenter Studies and Systematic Reviews
Laure Wynants, Kim Zhipei Wang, Sabine Grimm +5
External validation studies have finite sample sizes, creating uncertainty about whether a prediction model's Net Benefit (NB) exceeds default strategies' NB. The expected value of…