2 papers
cs.CL2026
Evaluating Fine-Tuned and Base Language Models in Maternal and Vaccination Healthcare for African Settings
Abdulquddus Ajibade, Oluwaseun Odunsi, Iyinoluwa Animasaun +4
Background: Large language models (LLMs) can improve healthcare information delivery in low-resource settings but may produce inaccurate or culturally inappropriate advice. This st…
cs.CL2026
MamaBench: Benchmarking LLM Robustness in Maternal and Child Health Diagnosis through Counterfactual Clinical Perturbation
Thanni Adewuyi, Anuoluwa Sotome, Samuel Okoko +6
Large language models achieve strong scores on medical benchmarks, yet these benchmarks evaluate each question in isolation, providing no measure of whether a system can distinguis…