2 papers
cs.CL2026
Benchmarking Multi-turn Medical Diagnosis: Hold, Lure, and Self-Correction
Jinrui Fang, Runhan Chen, Xu Yang +9
Large language models (LLMs) achieve high accuracy in medical diagnosis when all clinical information is provided in a single turn, yet how they behave under multi-turn evidence ac…
cs.HC2026
YT-Pilot: Turning YouTube into Structured Learning Pathways with Context-Aware AI Support
Dina Albassam, Kexin Quan, Mengke Wu +3
YouTube is widely used for informal learning, where learners explore lectures and tutorials without a predefined curriculum. However, learning across videos remains fragmented: lea…