Publications (45)
Approximate Equivariance in Reinforcement Learning
Jung Yeon Park, Sujay Bhatt, Sihan Zeng +4
Learning in Stackelberg Mean Field Games: A Non-Asymptotic Analysis
Sihan Zeng, Benjamin Patrick Evans, Sujay Bhatt +3
A Hessian-Free Actor-Critic Algorithm for Bi-Level Reinforcement Learning with Applications to LLM Fine-Tuning
Sihan Zeng, Sujay Bhatt, Sumitra Ganesh +1
Scalable Representation Learning for Multimodal Tabular Transactions
Natraj Raman, Sumitra Ganesh, Manuela Veloso
Phantom -- A RL-driven multi-agent framework to model complex systems
Leo Ardon, Jared Vann, Deepeka Garg +2
O3D: Offline Data-driven Discovery and Distillation for Sequential Decision-Making with Large Language Models
Yuchen Xiao, Yanchao Sun, Mengda Xu +4
Simulate and Optimise: A two-layer mortgage simulator for designing novel mortgage assistance products
Leo Ardon, Benjamin Patrick Evans, Deepeka Garg +3
Towards a fully RL-based Market Simulator
Leo Ardon, Nelson Vadori, Thomas Spooner +3
AgentCrypt: Advancing Privacy and (Secure) Computation in AI Agent Collaboration
Harish Karthikeyan, Yue Guo, Leo de Castro +5
ChartAgent: A Multimodal Agent for Visually Grounded Reasoning in Complex Chart Question Answering
Rachneet Kaur, Nishan Srishankar, Zhen Zeng +2
Regularized Proportional Fairness Mechanism for Resource Allocation Without Money
Sihan Zeng, Sujay Bhatt, Alec Koppel +1
Calibration of Shared Equilibria in General Sum Partially Observable Markov Games
Nelson Vadori, Sumitra Ganesh, Prashant Reddy +1
No One Size Fits All: QueryBandits for Hallucination Mitigation
Nicole Cho, William Watson, Alec Koppel +2
Efficient Inverse Multiagent Learning
Denizalp Goktas, Amy Greenwald, Sadie Zhao +2
Certifiably Robust Policy Learning against Adversarial Communication in Multi-agent Systems
Yanchao Sun, Ruijie Zheng, Parisa Hassanzadeh +4
Downside Risk-Aware Equilibria for Strategic Decision-Making
Oliver Slumbers, Benjamin Patrick Evans, Sumitra Ganesh +1
Generating Structured Plan Representation of Procedures with LLMs
Deepeka Garg, Sihan Zeng, Sumitra Ganesh +1
Decentralized Convergence to Equilibrium Prices in Trading Networks
Edwin Lock, Benjamin Patrick Evans, Eleonora Kreacic +4
ADAGE: A generic two-layer framework for adaptive agent based modelling
Benjamin Patrick Evans, Sihan Zeng, Sumitra Ganesh +1
Factored Policy Gradients: Leveraging Structure for Efficient Learning in MOMDPs
Thomas Spooner, Nelson Vadori, Sumitra Ganesh
Reinforcement Learning for Market Making in a Multi-agent Dealer Market
Sumitra Ganesh, Nelson Vadori, Mengda Xu +3
Entropy-informed Decoding: Adaptive Information-Driven Branching
Benjamin Patrick Evans, Sumitra Ganesh, Leo Ardon
GenARM: Reward Guided Generation with Autoregressive Reward Model for Test-time Alignment
Yuancheng Xu, Udari Madhushani Sehwag, Alec Koppel +4
Towards Multi-Agent Reinforcement Learning driven Over-The-Counter Market Simulations
Nelson Vadori, Leo Ardon, Sumitra Ganesh +7
Continual Learning of Domain Knowledge from Human Feedback in Text-to-SQL
Thomas Cook, Kelly Patel, Sivapriya Vellaichamy +4
Learning in Herding Mean Field Games: Single-Loop Algorithm with Finite-Time Convergence Analysis
Sihan Zeng, Sujay Bhatt, Alec Koppel +1
Rethinking Neural Network Learning Rates: A Stackelberg Perspective
Sihan Zeng, Sujay Bhatt, Sumitra Ganesh
Learning and Calibrating Heterogeneous Bounded Rational Market Behaviour with Multi-Agent Reinforcement Learning
Benjamin Patrick Evans, Sumitra Ganesh
Consensus Multiplicative Weights Update: Learning to Learn using Projector-based Game Signatures
Nelson Vadori, Rahul Savani, Thomas Spooner +1
Inapplicable Actions Learning for Knowledge Transfer in Reinforcement Learning
Leo Ardon, Alberto Pozanco, Daniel Borrajo +1
What Makes a Good Query? Measuring the Impact of Human-Confusing Linguistic Features on LLM Performance
William Watson, Nicole Cho, Sumitra Ganesh +1
Partially Observable Contextual Bandits with Linear Payoffs
Sihan Zeng, Sujay Bhatt, Alec Koppel +1
QueryBandits for Hallucination Mitigation: Exploiting Semantic Features for No-Regret Rewriting
Nicole Cho, William Watson, Alec Koppel +2
Risk-Sensitive Reinforcement Learning: a Martingale Approach to Reward Uncertainty
Nelson Vadori, Sumitra Ganesh, Prashant Reddy +1
TASER: Table Agents for Schema-guided Extraction and Recommendation
Nicole Cho, Kirsty Fielding, William Watson +2
Sequential Fair Resource Allocation under a Markov Decision Process Framework
Parisa Hassanzadeh, Eleonora Kreacic, Sihan Zeng +2
Learning Payment-Free Resource Allocation Mechanisms
Sihan Zeng, Sujay Bhatt, Eleonora Kreacic +3
SlideAgent: Hierarchical Agentic Framework for Multi-Page Visual Document Understanding
Yiqiao Jin, Rachneet Kaur, Zhen Zeng +2
PADME: Procedure Aware DynaMic Execution
Deepeka Garg, Sihan Zeng, Annapoorani L. Narayanan +2
Modelling bounded rational decision-making through Wasserstein constraints
Benjamin Patrick Evans, Leo Ardon, Sumitra Ganesh
A Heterogeneous Agent Model of Mortgage Servicing: An Income-based Relief Analysis
Deepeka Garg, Benjamin Patrick Evans, Leo Ardon +5
Mixture of basis for interpretable continual learning with distribution shifts
Mengda Xu, Sumitra Ganesh, Pranay Pasula
Prune 'n Predict: Optimizing LLM Decision-making with Conformal Prediction
Harit Vishwakarma, Alan Mishler, Thomas Cook +3
In-Context Learning with Topological Information for Knowledge Graph Completion
Udari Madhushani Sehwag, Kassiani Papasotiriou, Jared Vann +1
Collab: Controlled Decoding using Mixture of Agents for LLM Alignment
Souradip Chakraborty, Sujay Bhatt, Udari Madhushani Sehwag +7