3 papers
cs.CL2025
LCFO: Long Context and Long Form Output Dataset and Benchmarking
Marta R. Costa-jussÃ, Pierre Andrews, Mariano Coria Meglioli +10
This paper presents the Long Context and Form Output (LCFO) benchmark, a novel evaluation framework for assessing gradual summarization and summary expansion capabilities across di…
cs.CL2025
BOUQuET: dataset, Benchmark and Open initiative for Universal Quality Evaluation in Translation
The Omnilingual MT Team, Pierre Andrews, Mikel Artetxe +14
BOUQuET is a multi-way, multicentric and multi-register/domain dataset and benchmark, and a broader collaborative initiative. This dataset is handcrafted in 8 non-English languages…
cs.CL2025
On the Role of Speech Data in Reducing Toxicity Detection Bias
Samuel J. Bell, Mariano Coria Meglioli, Megan Richards +6
Text toxicity detection systems exhibit significant biases, producing disproportionate rates of false positives on samples mentioning demographic groups. But what about toxicity de…