1 paper
Satyam Dwivedi, Sanjukta Ghosh, Shivam Dwivedi +7
Large Language Models (LLMs) perform well on many reasoning benchmarks, yet existing evaluations rarely assess their ability to distinguish between meaningful semantic relations an…