2 papers
cs.CL2026
Evaluating Text Creativity across Diverse Domains: A Dataset and Large Language Model Evaluator
Qian Cao, Xiting Wang, Yuzhuo Yuan +3
Creativity evaluation remains a challenging frontier for large language models (LLMs). Current evaluations heavily rely on inefficient and costly human judgments, hindering progres…
cs.CL2026
DPWriter: Reinforcement Learning with Diverse Planning Branching for Creative Writing
Qian Cao, Yahui Liu, Wei Bi +6
Reinforcement learning (RL)-based enhancement of large language models (LLMs) often leads to reduced output diversity, undermining their utility in open-ended tasks like creative w…