2 papers
cs.AI2026
ORAgentBench: Can LLM Agents Solve Challenging Operations Research Tasks End to End?
Jiajun Li, Mingshu Cai, Yixuan Li +5
Large language models are increasingly deployed as autonomous agents for multi-step tasks in executable environments, yet their ability to perform realistic operations research (OR…
cs.LG2026
StarOR: Synergizing Tree Search and Test-Time Reinforcement Learning for Optimization Modeling
Jiajun Li, Yu Ding, Shisi Guan +2
Optimization modeling is inherently hierarchical, requiring a precise sequence of symbolic commitments. Traditional learning-based automated optimization modeling methods improve m…