activity
20182021
most citedDelayed Feedback Modeling for the Entire Space Conversion Rate Prediction

4 citations · 5 across the 3 of their papers we have counts for

collaborators
Showing 2018Show all

5 papers · 1 filter

cs.LG2018

Policy Optimization with Model-based Explorations

Feiyang Pan, Qingpeng Cai, An-Xiang Zeng +5

Model-free reinforcement learning methods such as the Proximal Policy Optimization algorithm (PPO) have successfully applied in complex decision-making problems such as Atari games…

cs.LG2018

Speeding up the Metabolism in E-commerce by Reinforcement Mechanism Design

Hua-Lin He, Chun-Xiang Pan, Qing Da +1

In a large E-commerce platform, all the participants compete for impressions under the allocation mechanism of the platform. Existing methods mainly focus on the short-term return…

cs.AI2018

Virtual-Taobao: Virtualizing Real-world Online Retail Environment for Reinforcement Learning

Jing-Cheng Shi, Yang Yu, Qing Da +2

Applying reinforcement learning in physical-world tasks is extremely challenging. It is commonly infeasible to sample a large number of trials, as required by current reinforcement…

cs.IR2018

Accelerating E-Commerce Search Engine Ranking by Contextual Factor Selection

Yusen Zhan, Qing Da, Fei Xiao +2

In industrial large-scale search systems, such as Taobao.com search for commodities, the quality of the ranking result is getting continually improved by introducing more factors f…

cs.LG2018

Reinforcement Learning to Rank in E-Commerce Search Engine: Formalization, Analysis, and Application

Yujing Hu, Qing Da, Anxiang Zeng +2

In e-commerce platforms such as Amazon and TaoBao, ranking items in a search session is a typical multi-step decision-making problem. Learning to rank (LTR) methods have been widel…