NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (14)

cs.LG2025

Towards High Data Efficiency in Reinforcement Learning with Verifiable Reward

Xinyu Tang, Zhenduo Zhang, Yurou Liu +4

cs.SE2025

Towards Large Language Model Guided Kernel Direct Fuzzing

Xie Li, Zhaoyue Yuan, Zhenduo Zhang +2

cs.AI2025

Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning

Xiaoxue Cheng, Junyi Li, Zhenduo Zhang +4

cs.CL2025

Ring-lite: Scalable Reasoning via C3PO-Stabilized Reinforcement Learning for LLMs

Ling Team, Bin Hu, Cai Chen +43

cs.CL2026

Ring-Zero: Scaling Zero RL to a Trillion Parameters for Emergent Reasoning

Xinyu Tang, Qianggang Cao, Yurou Liu +13

The paper introduces a training pipeline that scales zero‑reinforcement‑learning to a trillion‑parameter language model, revealing emergent chain‑of‑thought reasoning abilities and…

#zero-shot reinforcement learning#large language models#chain-of-thought reasoning#scaling laws
cs.AI2025

SHARP: Synthesizing High-quality Aligned Reasoning Problems for Large Reasoning Models Reinforcement Learning

Xiong Jun Wu, Zhenduo Zhang, ZuJie Wen +11

cs.CL2026

Ling and Ring 2.6 Technical Report: Efficient and Instant Agentic Intelligence at Trillion-Parameter Scale

Ang Li, Ben Liu, Bin Han +215

cs.CL2025

Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model

Ling Team, Anqi Shen, Baihui Li +101

cs.CV2023

Improved Face Representation via Joint Label Classification and Supervised Contrastive Clustering

Zhenduo Zhang

cs.RO2025

Results of the 2024 CommonRoad Motion Planning Competition for Autonomous Vehicles

Yanliang Huang, Xia Yan, Peiran Yin +5

cs.LG2025

Are KANs Effective for Multivariate Time Series Forecasting?

Xiao Han, Xinfeng Zhang, Yiling Wu +2

cs.CV2023

CoIE: Chain-of-Instruct Editing for Multi-Attribute Face Manipulation

Zhenduo Zhang, Bo-Wen Zhang, Guang Liu

cs.LG2025

Every Sample Matters: Leveraging Mixture-of-Experts and High-Quality Data for Efficient and Accurate Code LLM

Codefuse, Ling Team, : +30

cs.CL2025

Rethinking Sample Polarity in Reinforcement Learning with Verifiable Rewards

Xinyu Tang, Yuliang Zhan, Zhixun Li +5