1 paper
Minato Kondo, Takehito Utsuro, Masaaki Nagata
In this paper, we propose a two-phase training approach where pre-trained large language models are continually pre-trained on parallel data and then supervised fine-tuned with a s…