18 citations · 26 across the 3 of their papers we have counts for
Showing cs.CLShow all
3 papers · 1 filter
cs.CL2021★ 6 cited
LICHEE: Improving Language Model Pre-training with Multi-grained Tokenization
Weidong Guo, Mingjun Zhao, Lusheng Zhang +5
Language model pre-training based on large corpora has achieved tremendous success in terms of constructing enriched contextual representations and has led to significant performan…
cs.CL2021
Verdi: Quality Estimation and Error Detection for Bilingual Corpora
Mingjun Zhao, Haijiang Wu, Di Niu +2
Translation Quality Estimation is critical to reducing post-editing efforts in machine translation and to cross-lingual corpus cleaning. As a research problem, quality estimation (…
cs.CL2020★ 2 cited
Reinforced Curriculum Learning on Pre-trained Neural Machine Translation Models
Mingjun Zhao, Haijiang Wu, Di Niu +1
The competitive performance of neural machine translation (NMT) critically relies on large amounts of training data. However, acquiring high-quality translation pairs requires expe…