2 papers
cs.CL2026
ROMPAR: Morphological Completion and Demographic Unlearning for Romanian-Accented Speech Recognition
Andrei-Marius Avram, Aureliu-Valentin Antonie, Åtefan-Bogdan Badea +3
Automated transcription of parliamentary proceedings faces significant hurdles due to demographic bias, dialectal variation, and technical artifacts such as utterance truncation du…
cs.CL2026
RoIt-XMASA: Multi-Domain Multilingual Sentiment Analysis Dataset for Romanian and Italian
Andrei-Marius Avram, Aureliu Valentin Antonie, Cosmin-Mircea Croitoru +2
We present RoIt-XMASA, a multilingual dataset that extends the Cross-lingual Multi-domain Amazon Sentiment Analysis to Italian and Romanian, comprising 36,000 labeled reviews acros…