2 papers
cs.LG2026
Evidence-based Distributional Alignment for Large Language Models
Viet-Thanh Pham, Lizhen Qu, Zhuang Li +1
Distributional alignment enables large language models (LLMs) to predict how a target population distributes its responses across answer options, rather than collapsing disagreemen…
cs.AI2026
LiveCultureBench: a Multi-Agent, Multi-Cultural Benchmark for Large Language Models in Dynamic Social Simulations
Viet-Thanh Pham, Lizhen Qu, Thuy-Trang Vu +2
Large language models (LLMs) are increasingly deployed as autonomous agents, yet evaluations focus primarily on task success rather than cultural appropriateness or evaluator relia…