works on

From the 1 of 16 linked papers with an AI index.

collaborators

16 papers

cs.DB2026

SiriusDeliver: Automating Data Warehouse Delivery at Tencent

Haining Xie, Xiaokai Zhou, Jiaming Yang +12

Enterprise data warehouses (DWs) support business-critical analytics, but warehouse task delivery remains a complicated production process involving context retrieval, workflow con…

cs.AI2026

DataClawEval: A Benchmark for Data Engineering Agents in Real Industrial Harness

Debin Meng, Jiaming Yang, Zefang Zong +4

The paper introduces DataClawEval, a benchmark that tests autonomous LLM agents on end-to-end data engineering tasks across multiple production-grade SQL and Spark engines using de…

cs.CL2026

Kimi K3: Open Frontier Intelligence

Kimi Team, Tongtong Bai, Yifan Bai +398

We introduce Kimi K3, a 2.8T parameter Mixture-of-Experts model with 104 billion activated parameters, native vision capabilities, and a 1-million-token context window. Kimi K3 is…

cs.AI2026

PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning

Yipeng Shi, Zhipeng Ma, Yue Wang +4

In long-horizon LLM agent reinforcement learning, weak policies often repeat similar failures, producing uninformative rollout trajectories and limiting effective policy optimizati…

cs.AI2026

ATOD: Annealed Turn-Aware On-Policy Distillation for Multi-Turn Agentic Tasks

Qitai Tan, Zefang Zong, Yang Li +3

Training small language-model agents for long-horizon interactive tasks requires both fast imitation and reward-driven improvement. On-policy distillation (OPD) provides dense teac…

cs.IR2026

NOVA: A Verification-Aware Agent Harness for Architecture Evolution in Industrial Recommender Systems

Shaohua Liu, Liang Fang, Yilong Sun +16

Industrial advertising recommender systems are continually improved through architecture modifications, yet production iteration remains expert-intensive because coordinated change…