2 papers
cs.CL2026
CyclicReflex: Improving Reasoning Models via Cyclical Reflection Token Scheduling
Chongyu Fan, Yihua Zhang, Jinghan Jia +2
Large reasoning models (LRMs), such as OpenAI's o1 and DeepSeek-R1, harness test-time scaling to perform multi-step reasoning for complex problem-solving. This reasoning process, e…
cs.AI2025
Bridging Models to Defend: A Population-Based Strategy for Robust Adversarial Defense
Ren Wang, Yuxuan Li, Can Chen +6
Adversarial robustness is a critical measure of a neural network's ability to withstand adversarial attacks at inference time. While robust training techniques have improved defens…