2 papers
cs.AI2026
ABC-Bench: An Agentic Bio-Capabilities Benchmark for Biosecurity
Andrew Bo Liu, Samira Nedungadi, Bryce Cai +3
Large language models (LLMs) are rapidly acquiring capabilities relevant to biological research, from literature synthesis to interpretation of experimental data. Increasingly, LLM…
cs.CY2026
Measuring Mid-2025 LLM-Assistance on Novice Performance in Biology
Shen Zhou Hong, Alex Kleinman, Alyssa Mathiowetz +9
Large language models (LLMs) perform strongly on biological benchmarks, raising concerns that they may help novice actors acquire dual-use laboratory skills. Yet, whether this tran…