4 citations · 5 across the 3 of their papers we have counts for
5 papers · 1 filter
Policy Optimization with Model-based Explorations
Feiyang Pan, Qingpeng Cai, An-Xiang Zeng +5
Model-free reinforcement learning methods such as the Proximal Policy Optimization algorithm (PPO) have successfully applied in complex decision-making problems such as Atari games…
Speeding up the Metabolism in E-commerce by Reinforcement Mechanism Design
Hua-Lin He, Chun-Xiang Pan, Qing Da +1
In a large E-commerce platform, all the participants compete for impressions under the allocation mechanism of the platform. Existing methods mainly focus on the short-term return…
Virtual-Taobao: Virtualizing Real-world Online Retail Environment for Reinforcement Learning
Jing-Cheng Shi, Yang Yu, Qing Da +2
Applying reinforcement learning in physical-world tasks is extremely challenging. It is commonly infeasible to sample a large number of trials, as required by current reinforcement…
Accelerating E-Commerce Search Engine Ranking by Contextual Factor Selection
Yusen Zhan, Qing Da, Fei Xiao +2
In industrial large-scale search systems, such as Taobao.com search for commodities, the quality of the ranking result is getting continually improved by introducing more factors f…
Reinforcement Learning to Rank in E-Commerce Search Engine: Formalization, Analysis, and Application
Yujing Hu, Qing Da, Anxiang Zeng +2
In e-commerce platforms such as Amazon and TaoBao, ranking items in a search session is a typical multi-step decision-making problem. Learning to rank (LTR) methods have been widel…