2 papers
cs.CL2026
How far can bias go? Tracing bias from pretraining data to alignment
Marion Thaler, Abdullatif Köksal, Alina Leidinger +2
As LLMs are increasingly integrated into user-facing applications, addressing biases that perpetuate societal inequalities is crucial. While much work has gone into measuring or mi…
cs.CL2024
MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions
Abdullatif Köksal, Marion Thaler, Ayyoob Imani +3
Instruction tuning enhances large language models (LLMs) by aligning them with human preferences across diverse tasks. Traditional approaches to create instruction tuning datasets…