collaborators

5 papers

cs.AI2025

AdaR: A Framework for Equipping LLMs with Adaptive Reasoning

Zhejian Lai, Xiang Geng, Zhijun Wang +7

Mathematical reasoning is a primary indicator of large language models (LLMs) intelligence. However, existing LLMs exhibit failures in robustness and generalization. This paper att…

cs.CL2025

Why Not Transform Chat Large Language Models to Non-English?

Xiang Geng, Ming Zhu, Jiahuan Li +14

The scarcity of non-English data limits the development of non-English large language models (LLMs). Transforming English-centric LLMs to non-English has been identified as an effe…

cs.CL2025

Investigating and Scaling up Code-Switching for Multilingual Language Model Pre-Training

Zhijun Wang, Jiahuan Li, Hao Zhou +7

Large language models (LLMs) exhibit remarkable multilingual capabilities despite the extreme language imbalance in the pre-training data. In this paper, we closely examine the rea…

cs.CL2024

PreAlign: Boosting Cross-Lingual Transfer by Early Establishment of Multilingual Alignment

Jiahuan Li, Shujian Huang, Aarron Ching +2

Large language models demonstrate reasonable multilingual abilities, despite predominantly English-centric pretraining. However, the spontaneous multilingual alignment in these mod…

cs.CL2024

Formality is Favored: Unraveling the Learning Preferences of Large Language Models on Data with Conflicting Knowledge

Jiahuan Li, Yiqing Cao, Shujian Huang +1

Having been trained on massive pretraining data, large language models have shown excellent performance on many knowledge-intensive tasks. However, pretraining data tends to contai…