15 papers · 1 filter
Soft Token Alignment for Cross-Lingual Reasoning
Jiayi He, Jungsoo Park, Wei Xu +1
Multilingual large language models often produce inconsistent reasoning and answers for semantically equivalent prompts in different languages. Prior work suggests that intermediat…
Investigating and Alleviating Harm Amplification in LLM Interactions
Ruohao Guo, Wei Xu, Alan Ritter
Large language models (LLMs) can serve as helpful assistants, yet they can equally function as harm amplifiers that enable malicious users to achieve harmful outcomes beyond their…
Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages
Tarek Naous, Anagha Savit, Carlos Rafael Catalan +17
As Large Language Models (LLMs) develop stronger multilingual capabilities, their sensitivity to culturally diverse entities becomes increasingly important. Prior work by Naous et…
Learning to Route Languages for Multilingual Policy Optimization
Geyang Guo, Hiromi Wakaki, Yuki Mitsufuji +2
Large language models~(LLMs) are trained on heterogeneous multilingual corpora, yet existing policy optimization methods often implicitly restrict each training question to a singl…
Probabilistic Reasoning with LLMs for k-anonymity Estimation
Jonathan Zheng, Sauvik Das, Alan Ritter +1
Probabilistic reasoning is a key aspect of both human and artificial intelligence that allows for handling uncertainty and ambiguity in decision-making. In this paper, we introduce…
SimulatorArena: Are User Simulators Reliable Proxies for Multi-Turn Evaluation of AI Assistants?
Yao Dou, Michel Galley, Baolin Peng +6
Large language models (LLMs) are increasingly used in interactive applications, and human evaluation remains the gold standard for assessing their performance in multi-turn convers…