2 citations · 5 across the 24 of their papers we have counts for
4 papers · 1 filter
TACT: Taxonomy-Aligned Post-Training for Pedagogically Adaptive English Tutoring
Dongjie Yang, Siyan Lin, Leixian Shen +3
Large language models (LLMs) are increasingly used to provide conversational practice for English-as-a-second-language (ESL) learners. Effective ESL tutoring, however, requires mor…
Fewer Clarifications, Better Code: Benchmarking Cross-Session Personalized Ambiguity Adaptation in Coding Assistants
Zijian Xu, Wenshuo Zhang, Zisen Qin +4
AI-assisted coding increasingly translates informal user intent into executable software, yet coding requests often contain ambiguities that recur in user-specific ways across task…
Are LLMs Ready for Scientific Discovery? A Capability-Oriented Benchmark for AI Scientists
Chuhan Shi, Xiaoquan Ren, Sicheng Song +3
Existing benchmarks for scientific data analysis evaluate LLMs primarily on code execution or workflow completion, overlooking that scientific analysis serves to support distinct t…
TeachArena: Are Language Agents Ready for Realistic Teaching Work?
Zixin Chen, Peng Liu, Rui Sheng +6
Language agents are increasingly deployed in professional workflows, yet tutoring remains a high-stakes capability that existing evaluations only partially capture. Effective tutor…