1 paper
Wanqing Cui, Wei Huang, Keping Bi +2
Commonsense plausibility estimation is critical for evaluating language models (LMs), yet existing generative approaches--reliant on likelihoods or verbalized judgments--struggle w…