NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (45)

cs.LG2025

Approximate Equivariance in Reinforcement Learning

Jung Yeon Park, Sujay Bhatt, Sihan Zeng +4

cs.LG2025

Learning in Stackelberg Mean Field Games: A Non-Asymptotic Analysis

Sihan Zeng, Benjamin Patrick Evans, Sujay Bhatt +3

cs.LG2026

A Hessian-Free Actor-Critic Algorithm for Bi-Level Reinforcement Learning with Applications to LLM Fine-Tuning

Sihan Zeng, Sujay Bhatt, Sumitra Ganesh +1

cs.LG2024

Scalable Representation Learning for Multimodal Tabular Transactions

Natraj Raman, Sumitra Ganesh, Manuela Veloso

cs.AI2023

Phantom -- A RL-driven multi-agent framework to model complex systems

Leo Ardon, Jared Vann, Deepeka Garg +2

cs.AI2024

O3D: Offline Data-driven Discovery and Distillation for Sequential Decision-Making with Large Language Models

Yuchen Xiao, Yanchao Sun, Mengda Xu +4

cs.MA2024

Simulate and Optimise: A two-layer mortgage simulator for designing novel mortgage assistance products

Leo Ardon, Benjamin Patrick Evans, Deepeka Garg +3

cs.MA2021

Towards a fully RL-based Market Simulator

Leo Ardon, Nelson Vadori, Thomas Spooner +3

cs.CR2026

AgentCrypt: Advancing Privacy and (Secure) Computation in AI Agent Collaboration

Harish Karthikeyan, Yue Guo, Leo de Castro +5

cs.AI2026

ChartAgent: A Multimodal Agent for Visually Grounded Reasoning in Complex Chart Question Answering

Rachneet Kaur, Nishan Srishankar, Zhen Zeng +2

cs.GT2025

Regularized Proportional Fairness Mechanism for Resource Allocation Without Money

Sihan Zeng, Sujay Bhatt, Alec Koppel +1

cs.MA2020

Calibration of Shared Equilibria in General Sum Partially Observable Markov Games

Nelson Vadori, Sumitra Ganesh, Prashant Reddy +1

cs.CL2026

No One Size Fits All: QueryBandits for Hallucination Mitigation

Nicole Cho, William Watson, Alec Koppel +2

cs.GT2025

Efficient Inverse Multiagent Learning

Denizalp Goktas, Amy Greenwald, Sadie Zhao +2

cs.LG2022

Certifiably Robust Policy Learning against Adversarial Communication in Multi-agent Systems

Yanchao Sun, Ruijie Zheng, Parisa Hassanzadeh +4

cs.GT2025

Downside Risk-Aware Equilibria for Strategic Decision-Making

Oliver Slumbers, Benjamin Patrick Evans, Sumitra Ganesh +1

cs.SE2025

Generating Structured Plan Representation of Procedures with LLMs

Deepeka Garg, Sihan Zeng, Sumitra Ganesh +1

cs.GT2025

Decentralized Convergence to Equilibrium Prices in Trading Networks

Edwin Lock, Benjamin Patrick Evans, Eleonora Kreacic +4

cs.MA2025

ADAGE: A generic two-layer framework for adaptive agent based modelling

Benjamin Patrick Evans, Sihan Zeng, Sumitra Ganesh +1

cs.LG2021

Factored Policy Gradients: Leveraging Structure for Efficient Learning in MOMDPs

Thomas Spooner, Nelson Vadori, Sumitra Ganesh

q-fin.TR2019

Reinforcement Learning for Market Making in a Multi-agent Dealer Market

Sumitra Ganesh, Nelson Vadori, Mengda Xu +3

cs.LG2026

Entropy-informed Decoding: Adaptive Information-Driven Branching

Benjamin Patrick Evans, Sumitra Ganesh, Leo Ardon

cs.CL2025

GenARM: Reward Guided Generation with Autoregressive Reward Model for Test-time Alignment

Yuancheng Xu, Udari Madhushani Sehwag, Alec Koppel +4

cs.MA2023

Towards Multi-Agent Reinforcement Learning driven Over-The-Counter Market Simulations

Nelson Vadori, Leo Ardon, Sumitra Ganesh +7

cs.CL2025

Continual Learning of Domain Knowledge from Human Feedback in Text-to-SQL

Thomas Cook, Kelly Patel, Sivapriya Vellaichamy +4

math.OC2025

Learning in Herding Mean Field Games: Single-Loop Algorithm with Finite-Time Convergence Analysis

Sihan Zeng, Sujay Bhatt, Alec Koppel +1

cs.LG2026

Rethinking Neural Network Learning Rates: A Stackelberg Perspective

Sihan Zeng, Sujay Bhatt, Sumitra Ganesh

cs.MA2024

Learning and Calibrating Heterogeneous Bounded Rational Market Behaviour with Multi-Agent Reinforcement Learning

Benjamin Patrick Evans, Sumitra Ganesh

cs.GT2022

Consensus Multiplicative Weights Update: Learning to Learn using Projector-based Game Signatures

Nelson Vadori, Rahul Savani, Thomas Spooner +1

cs.LG2023

Inapplicable Actions Learning for Knowledge Transfer in Reinforcement Learning

Leo Ardon, Alberto Pozanco, Daniel Borrajo +1

cs.CL2026

What Makes a Good Query? Measuring the Impact of Human-Confusing Linguistic Features on LLM Performance

William Watson, Nicole Cho, Sumitra Ganesh +1

cs.LG2024

Partially Observable Contextual Bandits with Linear Payoffs

Sihan Zeng, Sujay Bhatt, Alec Koppel +1

cs.CL2025

QueryBandits for Hallucination Mitigation: Exploiting Semantic Features for No-Regret Rewriting

Nicole Cho, William Watson, Alec Koppel +2

cs.LG2020

Risk-Sensitive Reinforcement Learning: a Martingale Approach to Reward Uncertainty

Nelson Vadori, Sumitra Ganesh, Prashant Reddy +1

cs.AI2026

TASER: Table Agents for Schema-guided Extraction and Recommendation

Nicole Cho, Kirsty Fielding, William Watson +2

cs.LG2023

Sequential Fair Resource Allocation under a Markov Decision Process Framework

Parisa Hassanzadeh, Eleonora Kreacic, Sihan Zeng +2

cs.GT2024

Learning Payment-Free Resource Allocation Mechanisms

Sihan Zeng, Sujay Bhatt, Eleonora Kreacic +3

cs.CL2026

SlideAgent: Hierarchical Agentic Framework for Multi-Page Visual Document Understanding

Yiqiao Jin, Rachneet Kaur, Zhen Zeng +2

cs.AI2025

PADME: Procedure Aware DynaMic Execution

Deepeka Garg, Sihan Zeng, Annapoorani L. Narayanan +2

cs.LG2025

Modelling bounded rational decision-making through Wasserstein constraints

Benjamin Patrick Evans, Leo Ardon, Sumitra Ganesh

cs.MA2024

A Heterogeneous Agent Model of Mortgage Servicing: An Income-based Relief Analysis

Deepeka Garg, Benjamin Patrick Evans, Leo Ardon +5

cs.LG2022

Mixture of basis for interpretable continual learning with distribution shifts

Mengda Xu, Sumitra Ganesh, Pranay Pasula

cs.LG2025

Prune 'n Predict: Optimizing LLM Decision-making with Conformal Prediction

Harit Vishwakarma, Alan Mishler, Thomas Cook +3

cs.CL2024

In-Context Learning with Topological Information for Knowledge Graph Completion

Udari Madhushani Sehwag, Kassiani Papasotiriou, Jared Vann +1

cs.CL2025

Collab: Controlled Decoding using Mixture of Agents for LLM Alignment

Souradip Chakraborty, Sujay Bhatt, Udari Madhushani Sehwag +7