Publications (36)
Breaking Training Bottlenecks: Effective and Stable Reinforcement Learning for Coding Models
Zongqian Li, Shaohan Huang, Zewen Chi +5
Complicated Table Structure Recognition
Zewen Chi, Heyan Huang, Heng-Da Xu +3
Can Monolingual Pretrained Models Help Cross-Lingual Classification?
Zewen Chi, Li Dong, Furu Wei +2
Black-Box On-Policy Distillation of Large Language Models
Tianzhu Ye, Li Dong, Zewen Chi +3
Unsupervised Question Answering via Answer Diversifying
Yuxiang Nie, Heyan Huang, Zewen Chi +1
Bridging The Gap: Entailment Fused-T5 for Open-retrieval Conversational Machine Reading Comprehension
Xiao Zhang, Heyan Huang, Zewen Chi +1
On the Representation Collapse of Sparse Mixture of Experts
Zewen Chi, Li Dong, Shaohan Huang +9
InfoXLM: An Information-Theoretic Framework for Cross-Lingual Language Model Pre-Training
Zewen Chi, Li Dong, Furu Wei +7
ProtLLM: An Interleaved Protein-Language LLM with Protein-as-Word Pre-Training
Le Zhuo, Zewen Chi, Minghao Xu +5
VIBEVOICE-ASR Technical Report
Zhiliang Peng, Jianwei Yu, Yaoyao Chang +21
MT6: Multilingual Pretrained Text-to-Text Transformer with Translation Pairs
Zewen Chi, Li Dong, Shuming Ma +3
Think Only When You Need with Large Hybrid-Reasoning Models
Lingjie Jiang, Xun Wu, Shaohan Huang +7
Optimizing Prompts for Text-to-Image Generation
Yaru Hao, Zewen Chi, Li Dong +1
XLM-T: Scaling up Multilingual Machine Translation with Pretrained Cross-lingual Transformer Encoders
Shuming Ma, Jian Yang, Haoyang Huang +10
The Era of Agentic Organization: Learning to Organize with Language Models
Zewen Chi, Li Dong, Qingxiu Dong +4
Consistency Regularization for Cross-Lingual Fine-Tuning
Bo Zheng, Li Dong, Shaohan Huang +7
Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts
Di Zhang, Xun Wu, Shaohan Huang +6
Sparse-BitNet: 1.58-bit LLMs are Naturally Friendly to Semi-Structured Sparsity
Di Zhang, Xun Wu, Shaohan Huang +9
Beyond English-Centric Bitexts for Better Multilingual Language Representation Learning
Barun Patra, Saksham Singhal, Shaohan Huang +5
XLM-E: Cross-lingual Language Model Pre-training via ELECTRA
Zewen Chi, Shaohan Huang, Li Dong +8
On-Policy RL with Optimal Reward Baseline
Yaru Hao, Li Dong, Xun Wu +3
Language Models are General-Purpose Interfaces
Yaru Hao, Haoyu Song, Li Dong +5
Language Is Not All You Need: Aligning Perception with Language Models
Shaohan Huang, Li Dong, Wenhui Wang +15
SlideSparse: Fast and Flexible (2N-2):2N Structured Sparsity
Hanyong Shao, Yingbo Hao, Ting Song +10
TorchScale: Transformers at Scale
Shuming Ma, Hongyu Wang, Shaohan Huang +8
Improving Pretrained Cross-Lingual Language Models via Self-Labeled Word Alignment
Zewen Chi, Li Dong, Bo Zheng +4
Generating Informative Dialogue Responses with Keywords-Guided Networks
Heng-Da Xu, Xian-Ling Mao, Zewen Chi +3
Reward Reasoning Model
Jiaxin Guo, Zewen Chi, Li Dong +4
Measuring Cross-Lingual Transferability of Multilingual Transformers on Sentence Classification
Zewen Chi, Heyan Huang, Xian-Ling Mao
A Robust and Domain-Adaptive Approach for Low-Resource Named Entity Recognition
Houjin Yu, Xian-Ling Mao, Zewen Chi +2
FlashBack:Efficient Retrieval-Augmented Language Modeling for Long Context Inference
Runheng Liu, Xingchen Xiao, Heyan Huang +2
Cross-Lingual Natural Language Generation via Pre-Training
Zewen Chi, Li Dong, Furu Wei +3
Unifying Cross-lingual Summarization and Machine Translation with Compression Rate
Yu Bai, Heyan Huang, Kai Fan +5
Cross-Lingual Language Model Meta-Pretraining
Zewen Chi, Heyan Huang, Luyang Liu +2
Cross-Lingual Phrase Retrieval
Heqi Zheng, Xiao Zhang, Zewen Chi +5
ET5: A Novel End-to-end Framework for Conversational Machine Reading Comprehension
Xiao Zhang, Heyan Huang, Zewen Chi +1