Publications (24)
Multiple Stopping Time POMDPs: Structural Results & Application in Interactive Advertising in Social Media
Vikram Krishnamurthy, Anup Aprem, Sujay Bhatt
Oracle-free Reinforcement Learning in Mean-Field Games along a Single Sample Path
Muhammad Aneeq uz Zaman, Alec Koppel, Sujay Bhatt +1
Learning Payment-Free Resource Allocation Mechanisms
Sihan Zeng, Sujay Bhatt, Eleonora Kreacic +3
Decentralized Convergence to Equilibrium Prices in Trading Networks
Edwin Lock, Benjamin Patrick Evans, Eleonora Kreacic +4
Adaptive Polling in Hierarchical Social Networks using Blackwell Dominance
Sujay Bhatt, Vikram Krishnamurthy
Learning in Herding Mean Field Games: Single-Loop Algorithm with Finite-Time Convergence Analysis
Sihan Zeng, Sujay Bhatt, Alec Koppel +1
Rethinking Neural Network Learning Rates: A Stackelberg Perspective
Sihan Zeng, Sujay Bhatt, Sumitra Ganesh
Sequential Detection of Market shocks using Risk-averse Agent Based Models
Vikram Krishnamurthy, Sujay Bhatt
Offline Change Detection under Contamination
Sujay Bhatt, Guanhua Fang, Ping Li
Collab: Controlled Decoding using Mixture of Agents for LLM Alignment
Souradip Chakraborty, Sujay Bhatt, Udari Madhushani Sehwag +7
Opportunistic Advertisement Scheduling in Live Social Media: A Multiple Stopping Time POMDP Approach
Vikram Krishnamurthy, Anup Aprem, Sujay Bhatt
Catoni-Style Change Point Detection for Regret Minimization in Non-Stationary Heavy-Tailed Bandits
Gianmarco Genalti, Sujay Bhatt, Nicola Gatti +1
Approximate Equivariance in Reinforcement Learning
Jung Yeon Park, Sujay Bhatt, Sihan Zeng +4
Adversarial Linear-Quadratic Mean-Field Games over Multigraphs
Muhammad Aneeq uz Zaman, Sujay Bhatt, Tamer BaÅar
Controlled Sequential Information Fusion with Social Sensors
Sujay Bhatt, Vikram Krishnamurthy
Policy Gradient using Weak Derivatives for Reinforcement Learning
Sujay Bhatt, Alec Koppel, Vikram Krishnamurthy
Learning in Stackelberg Mean Field Games: A Non-Asymptotic Analysis
Sihan Zeng, Benjamin Patrick Evans, Sujay Bhatt +3
A Hessian-Free Actor-Critic Algorithm for Bi-Level Reinforcement Learning with Applications to LLM Fine-Tuning
Sihan Zeng, Sujay Bhatt, Sumitra Ganesh +1
Partially Observable Contextual Bandits with Linear Payoffs
Sihan Zeng, Sujay Bhatt, Alec Koppel +1
Tracking Infection Diffusion in Social Networks: Filtering Algorithms and Threshold Bounds
Vikram Krishnamurthy, Sujay Bhatt, Tavis Pedersen
Catoni-style Confidence Sequences under Infinite Variance
Sujay Bhatt, Guanhua Fang, Ping Li +1
Regularized Proportional Fairness Mechanism for Resource Allocation Without Money
Sihan Zeng, Sujay Bhatt, Alec Koppel +1
Extreme Bandits using Robust Statistics
Sujay Bhatt, Ping Li, Gennady Samorodnitsky
Controlled Information Fusion with Risk-Averse CVaR Social Sensors
Sujay Bhatt, Vikram Krishnamurthy