2 papers
cs.LG2026
Provably avoiding over-optimization in Direct Preference Optimization without knowing the data distribution
Adam Barla, Emanuele Nevali, Luca Viano +1
We introduce PEPO (Pessimistic Ensemble based Preference Optimization), a single-step Direct Preference Optimization (DPO)-like algorithm to mitigate the well-known over-optimizati…
econ.GN2025
Carrot, stick, or both? Price incentives for sustainable food choice in competitive environments
Francesco Salvi, Giuseppe Russo, Adam Barla +2
Meat consumption is a major driver of global greenhouse gas emissions. While pricing interventions have shown potential to reduce meat intake, previous studies have focused on high…