2 papers
cs.CL2026
RubricsTree: Scalable and Evolving Open-Ended Evaluation of Personal Health Agents across Health Memory and Medical Skills
Weizhi Zhang, Zechen Li, Hamid Palangi +16
The LLM-empowered personal health agents with user health (sensor) metrics have offered a promising pathway to alleviate global disparities in healthcare access. However, large-sca…
cs.AI2026
SymptomAI: Toward a Conversational AI Agent for Everyday Symptom Assessment
Joseph Breda, Fadi Yousif, Beszel Hawkins +30
Language models excel at diagnostic assessments on curated medical case-studies and vignettes, performing on par with, or better than, clinical professionals. However, existing stu…