1 paper
Said Taghadouini, Adrien Cavaillès, Baptiste Aubertin
We present LightOnOCR-2-1B, a 1B-parameter end-to-end multilingual vision--language model that converts document images (e.g., PDFs) into clean, naturally ordered text without brit…