1 citations · 1 across the 1 of their papers we have counts for
3 papers
cs.CL2026
STAPO: Stabilizing Reinforcement Learning for LLMs by Silencing Rare Spurious Tokens
Shiqi Liu, Zeyu He, Guojian Zhan +10
Reinforcement Learning (RL) has significantly improved large language model reasoning, but existing RL fine-tuning methods rely heavily on heuristic techniques such as entropy regu…
cs.CV2025
Hierarchical Feature-level Reverse Propagation for Post-Training Neural Networks
Ni Ding, Shuchang Wang, Lei He +2
End-to-end neural networks have become a dominant paradigm in autonomous driving, where reliable deployment requires controllable post-training adaptation and improved transparency…
cs.LG2023★ 1 cited
Training Multi-layer Neural Networks on Ising Machine
Xujie Song, Tong Liu, Shengbo Eben Li +3
As a dedicated quantum device, Ising machines could solve large-scale binary optimization problems in milliseconds. There is emerging interest in utilizing Ising machines to train…