1 paper
Jerry Junyang Cheung, Shiyao Shen, Yuchen Zhuang +3
Despite recent advances in large language models (LLMs) for materials science, there is a lack of benchmarks for evaluating their domain-specific knowledge and complex reasoning ab…