1 paper · 1 filter
Satyam Dwivedi, Sanjukta Ghosh, Shivam Dwivedi +7
Large Language Models (LLMs) perform well on many reasoning benchmarks, yet existing evaluations rarely assess their ability to distinguish between meaningful semantic relations an…