1 paper · 1 filter
Bryce Cai, Geetha Jeyapragasan, Samira Nedungadi +2
We introduce ABLE, a benchmark for evaluating LLM agents' ability to use biological AI models (BAIMs), such as ProteinMPNN and AlphaFold3, in dual-use protein design workflows. ABL…