1 paper
Emily Reif, Claire Yang, Jared Hwang +3
Users typically interact with and evaluate language models via single outputs, but each output is just one sample from a broad distribution of possible completions. This interactio…