Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Reward Hacking as Equilibrium under Finite Evaluation
Jiacheng Wang, Jinbin Huang
We prove that under five minimal axioms -- multi-dimensional quality, finite evaluation, effective optimization, resource finiteness, and combinatorial interaction -- any optimized…
cs.AI2025
Does More Inference-Time Compute Really Help Robustness?
Tong Wu, Chong Xiang, Jiachen T. Wang +4
Recently, Zaremba et al. demonstrated that increasing inference-time computation improves robustness in large proprietary reasoning LLMs. In this paper, we first show that smaller-…