Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
AI Alignment through a Game-theoretic Lens: A Survey
Yanan Cai, Zhongrui Zhao, Zhigang Lu +6
As large language models and increasingly capable AI agents are deployed in high-risk settings, aligning them with complex human values has become a central challenge. Existing ali…
cs.AI2026
Toward Trustworthy AI: Multi-Target Adversarial Attacks and Robust Defenses for Continuous Data Summarization
Yuefang Lian, Longkun Guo, Zhongrui Zhao +5
Trustworthy AI requires reliable data-processing pipelines, not only robust downstream predictive models. As an upstream component, data summarization determines which information…