1 paper
Yanan Cai, Zhongrui Zhao, Zhigang Lu +6
As large language models and increasingly capable AI agents are deployed in high-risk settings, aligning them with complex human values has become a central challenge. Existing ali…