1 paper · 1 filter
William Overman, Mohsen Bayati
Modern language model deployments must often balance competing objectives, for example, helpfulness versus harmlessness, cost versus accuracy, and reward versus safety. We introduc…