1 paper
Zijie Zhuang, Changxin Lao, Pengbo Xu +13
Research agents increasingly conduct multi-round machine-learning experiments in industrial recommendation settings and retain the resulting trajectories to guide later decisions.…