papers
Publications (14)
cs.LG2025
Towards High Data Efficiency in Reinforcement Learning with Verifiable Reward
Xinyu Tang, Zhenduo Zhang, Yurou Liu +4
cs.SE2025
Towards Large Language Model Guided Kernel Direct Fuzzing
Xie Li, Zhaoyue Yuan, Zhenduo Zhang +2
cs.AI2025
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
Xiaoxue Cheng, Junyi Li, Zhenduo Zhang +4
cs.CL2025
Ring-lite: Scalable Reasoning via C3PO-Stabilized Reinforcement Learning for LLMs
Ling Team, Bin Hu, Cai Chen +43
cs.CL2026
Ring-Zero: Scaling Zero RL to a Trillion Parameters for Emergent Reasoning
Xinyu Tang, Qianggang Cao, Yurou Liu +13
The paper introduces a training pipeline that scales zero‑reinforcement‑learning to a trillion‑parameter language model, revealing emergent chain‑of‑thought reasoning abilities and…
#zero-shot reinforcement learning#large language models#chain-of-thought reasoning#scaling laws
cs.AI2025
SHARP: Synthesizing High-quality Aligned Reasoning Problems for Large Reasoning Models Reinforcement Learning
Xiong Jun Wu, Zhenduo Zhang, ZuJie Wen +11
cs.CL2026
Ling and Ring 2.6 Technical Report: Efficient and Instant Agentic Intelligence at Trillion-Parameter Scale
Ang Li, Ben Liu, Bin Han +215
cs.CL2025
Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model
Ling Team, Anqi Shen, Baihui Li +101
cs.CV2023
Improved Face Representation via Joint Label Classification and Supervised Contrastive Clustering
Zhenduo Zhang
cs.RO2025
Results of the 2024 CommonRoad Motion Planning Competition for Autonomous Vehicles
Yanliang Huang, Xia Yan, Peiran Yin +5
cs.LG2025
Are KANs Effective for Multivariate Time Series Forecasting?
Xiao Han, Xinfeng Zhang, Yiling Wu +2
cs.CV2023
CoIE: Chain-of-Instruct Editing for Multi-Attribute Face Manipulation
Zhenduo Zhang, Bo-Wen Zhang, Guang Liu
cs.LG2025
Every Sample Matters: Leveraging Mixture-of-Experts and High-Quality Data for Efficient and Accurate Code LLM
Codefuse, Ling Team, : +30
cs.CL2025
Rethinking Sample Polarity in Reinforcement Learning with Verifiable Rewards
Xinyu Tang, Yuliang Zhan, Zhixun Li +5