3 papers
cs.SE2026
Training Versatile Coding Agents in Synthetic Environments
Yiqi Zhu, Apurva Gandhi, Graham Neubig
Prior works on training software engineering agents have explored utilizing existing resources such as issues on GitHub repositories to construct software engineering tasks and cor…
cs.CL2025
LegalRikai: Open Benchmark -- Benchmark for Complex Japanese Corporate Legal Tasks
Shogo Fujita, Yuji Naraki, Yiqing Zhu +1
This paper introduces LegalRikai: Open Benchmark, a new benchmark comprising four complex tasks that emulate Japanese corporate legal practices. The benchmark was created by legal…
cs.DC2025
AIBrix: Towards Scalable, Cost-Effective Large Language Model Inference Infrastructure
The AIBrix Team, Jiaxin Shan, Varun Gupta +24
We introduce AIBrix, a cloud-native, open-source framework designed to optimize and simplify large-scale LLM deployment in cloud environments. Unlike traditional cloud-native stack…