1 paper
MZ Naser, Ahmad Bani Awwad, Zoie McCreery +8
The Engineering Reasoning and Instruction (ERI) benchmark is a taxonomy-driven instruction dataset designed to train and evaluate engineering-capable large language models (LLMs) a…