2 papers
cs.LG2026
Procedural Fairness Failures in RLHF from Preference Averaging
M P V S Gopinadh, Karthik Kamuju, Kummari Avinash +2
Reinforcement Learning from Human Feedback (RLHF) aggregates heterogeneous preferences into a single reward model, assuming preference homogeneity. When preferences are heterogeneo…
cs.CL2026
Regional Bias in Large Language Models
M P V S Gopinadh, Kappara Lakshmi Sindhu, Soma Sekhar Pandu Ranga Raju P +1
This study investigates regional bias in large language models (LLMs), an emerging concern in AI fairness and global representation. We evaluate ten prominent LLMs: GPT-3.5, GPT-4o…