1 paper
Tom Mackintosh, Harish Tayyar Madabushi, Claire Bonial
We probe large language models' ability to learn deep form-meaning mappings as defined by construction grammars. We introduce the ConTest-NLI benchmark of 80k sentences covering ei…