2 papers
cs.CL2026
DEBATE: A Large-Scale Benchmark for Evaluating Opinion Dynamics in Role-Playing LLM Agents
Yun-Shiuan Chuang, Ruixuan Tu, Chengtao Dai +9
Accurately modeling opinion change through social interactions is crucial for understanding and mitigating polarization, misinformation, and societal conflict. Recent work simulate…
cs.CL2026
When More Words Say Less: Decoupling Length and Specificity in Image Description Evaluation
Rhea Kapur, Robert Hawkins, Elisa Kreiss
Vision-language models (VLMs) are increasingly used to make visual content accessible via text-based descriptions. In current systems, however, description specificity is often con…