3 papers
cs.CL2025
Steerable Pluralism: Pluralistic Alignment via Few-Shot Comparative Regression
Jadie Adams, Brian Hu, Emily Veenhuis +5
Large language models (LLMs) are currently aligned using techniques such as reinforcement learning from human feedback (RLHF). However, these methods use scalar rewards that can on…
cs.CL2024
Language Models are Alignable Decision-Makers: Dataset and Application to the Medical Triage Domain
Brian Hu, Bill Ray, Alice Leung +4
In difficult decision-making scenarios, it is common to have conflicting opinions among expert human decision-makers as there may not be a single right answer. Such decisions may b…
cs.SI2023
Unsupervised Image Classification by Ideological Affiliation from User-Content Interaction Patterns
Xinyi Liu, Jinning Li, Dachun Sun +6
The proliferation of political memes in modern information campaigns calls for efficient solutions for image classification by ideological affiliation. While significant advances h…