Showing cs.LGShow all
2 papers · 1 filter
cs.LG2025
Granular feedback merits sophisticated aggregation
Anmol Kagrecha, Henrik Marklund, Potsawee Manakul +2
Human feedback is increasingly used across diverse applications like training AI models, developing recommender systems, and measuring public opinion -- with granular feedback ofte…
cs.LG2025
Misalignment from Treating Means as Ends
Henrik Marklund, Alex Infanger, Benjamin Van Roy
Reward functions, learned or manually specified, are rarely perfect. Instead of accurately expressing human goals, these reward functions are often distorted by human beliefs about…