1 paper · 1 filter
Chao Yang, Chaochao Lu, Yingchun Wang +1
Ensuring Artificial General Intelligence (AGI) reliably avoids harmful behaviors is a critical challenge, especially for systems with high autonomy or in safety-critical domains. D…