1 paper
Daniel Fein, Sebastian Russo, Violet Xiang +3
Evaluating creative writing generated by large language models (LLMs) remains challenging because open-ended narratives lack ground truths. Without performant automated evaluation…