1 paper
Jiacheng Shen, Masato Hagiwara, Milad Alizadeh +9
Large language models have shown strong performance on broad-domain knowledge and reasoning benchmarks, but it remains unclear how well language models handle specialized animal-re…