1 paper
Phuc Nguyen, Benjamin Zelditch, Joyce Chen +2
We present BanditLP, a scalable multi-stakeholder contextual bandit framework that unifies neural Thompson Sampling for learning objective-specific outcomes with a large-scale line…