1 paper · 1 filter
Yannis Karmim, Luis Marti, Djamé Seddah +1
Large Language Models fail at implicit multi-hop reasoning: a model answers "When was X born?" and "Who is Y's closest friend?" correctly but fails on "When was Y's closest f…