2 papers
cs.AI2026
Evaluating and Improving Pedagogical Fit in LLM-Based AI Tutors with the Pedagogical Suitability Index
Benjamin Barlog, Hudson Craig, Zedong Peng
Large language models (LLMs) are increasingly used as AI tutors, but a correct answer is not always a pedagogically appropriate one. In classroom learning, effective help depends n…
cs.SE2026
When Post-Anchor Metrics Fail: Stabilization Regimes in AI-Evidence Open-Source Projects
Hudson Craig, Benjamin Barlog, Chenggang Wang +2
Repository mining studies increasingly analyze AI-evidence projects, yet it remains unclear how to measure whether architectural changes create deferred stabilization obligations.…