1 paper
Andor Vári-Kakas, Ji Won Park, Natasa Tagasovska
Aligning large language models (LLMs) to desirable human values requires balancing multiple, potentially conflicting objectives such as helpfulness, truthfulness, and harmlessness,…