Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
SPM-Bench: Benchmarking Large Language Models for Scanning Probe Microscopy
Peiyao Xiao, Xiaogang Li, Xinyi Gao +7
As LLMs achieved breakthroughs in general reasoning, their proficiency in specialized scientific domains reveals pronounced gaps in existing benchmarks due to data contamination, i…
cs.AI2026
Rethinking Patient Education as Multi-turn Multi-modal Interaction
Zonghai Yao, Zhipeng Tang, Chengtao Lin +5
Most medical multimodal benchmarks focus on static tasks such as image question answering, report generation, and plain-language rewriting. Patient education is more demanding: sys…