4 papers
Argus: A General-Purpose Agentic Reasoning Runtime for Long-Horizon Tasks
Boxiu Li, Zimo Wen, Yijia Fan +24
Long-horizon reasoning requires an agentic runtime that can persist when evidence supports its current approach and pivot when measurements reveal failure, hidden constraints, or a…
Towards Efficient LLMs Annealing with Principled Sample Selection
Yuanjian Xu, Jianing Hao, Wanbo Zhang +2
The annealing phase is a pivotal convergence stage in LLM pre-training that ultimately determines final model quality. However, effectively selecting training data during this phas…
Game-Theoretic Lens on LLM-based Multi-Agent Systems
Jianing Hao, Han Ding, Yuanjian Xu +5
Large language models (LLMs) have demonstrated strong reasoning, planning, and communication abilities, enabling them to operate as autonomous agents in open environments. While si…
MILP-StuDio: MILP Instance Generation via Block Structure Decomposition
Haoyang Liu, Jie Wang, Wanbo Zhang +6
Mixed-integer linear programming (MILP) is one of the most popular mathematical formulations with numerous applications. In practice, improving the performance of MILP solvers ofte…