3 papers
cs.CL2025
Enhancing Systematic Reviews with Large Language Models: Using GPT-4 and Kimi
Dandan Chen Kaptur, Yue Huang, Xuejun Ryan Ji +2
This research delved into GPT-4 and Kimi, two Large Language Models (LLMs), for systematic reviews. We evaluated their performance by comparing LLM-generated codes with human-gener…
stat.AP2024
Evaluating Four Methods for Detecting Differential Item Functioning in Large-Scale Assessments with More Than Two Groups
Dandan Chen Kaptur, Jinming Zhang
This study evaluated four multi-group differential item functioning (DIF) methods (the root mean square deviation approach, Wald-1, generalized logistic regression procedure, and g…
stat.AP2024
Examinees' Rapid-Guessing Patterns in Computerized Adaptive Testing for Interim Assessment: From Hierarchical Clustering
Dandan Chen Kaptur, Elizabeth Patton, Logan Rome
Interim assessment is frequently administered via computerized adaptive testing (CAT), offering direct support to teaching and learning. This study attempted to fill a vital knowle…