Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
ArborKV: Structure-Aware KV Cache Management for Scaling Tree-based LLM Reasoning
Yeqiu Chen, Ziyan Liu, Zhenxin Huang +3
Recent progress in LLM reasoning has increasingly shifted from single-pass generation to explicit search over intermediate reasoning states. Tree-of-Thoughts (ToT) organizes infere…
cs.AI2026
Scheduling Your LLM Reinforcement Learning with Reasoning Trees
Hong Wang, Zhezheng Hao, Jian Luo +6
Using Reinforcement Learning with Verifiable Rewards (RLVR) to optimize Large Language Models (LLMs) can be conceptualized as progressively editing a query's `Reasoning Tree'. This…