Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
SLAT: Segment-Level Adaptive Trimming for Efficient CoT Reasoning
Jian Yao, Xiongcai Luo, Ran Cheng +1
Recent advances in Large Reasoning Models have significantly improved chain-of-thought (CoT) capabilities via reinforcement learning (RL). However, generated reasoning chains frequ…
cs.AI2026
VAR-MATH: Probing True Mathematical Reasoning in LLMS via Symbolic Multi-Instance Benchmarks
Jian Yao, Ran Cheng, Kay Chen Tan
Recent advances in reinforcement learning (RL) have led to substantial improvements in the mathematical reasoning abilities of LLMs, as measured by standard benchmarks. Yet these g…