2 papers
cs.LG2026
SANE: State Anomaly Neutralization for Stable Extreme-Context Delta-Rule Models
Qingwen Lin, Boyan Xu, Xiao Liu +2
Delta-Rule recurrent models maintain a fixed-size state, enabling inference memory but potentially becoming unstable under extreme-context extrapolation. By tracking RWKV-7…
cs.AI2026
ENTRA: Entropy-Based Redundancy Avoidance in Large Language Model Reasoning
Ruichu Cai, Haopeng Du, Qingwen Lin +3
Large Reasoning Models (LRMs) often suffer from overthinking, generating unnecessarily long reasoning chains even for simple tasks. This leads to substantial computational overhead…