1 paper · 1 filter
Xinyun Chen, Ryan A. Chi, Xuezhi Wang +1
Large language models (LLMs) have accomplished remarkable reasoning performance in various domains. However, in the domain of reasoning tasks, we discover a frailty: LLMs are surpr…