2 papers
cs.LG2025
On the Information Processing of One-Dimensional Wasserstein Distances with Finite Samples
Cheongjae Jang, Jonghyun Won, Soyeon Jun +3
Leveraging the Wasserstein distance -- a summation of sample-wise transport distances in data space -- is advantageous in many applications for measuring support differences betwee…
cs.LG2024
Kernel Metric Learning for In-Sample Off-Policy Evaluation of Deterministic RL Policies
Haanvid Lee, Tri Wahyu Guntara, Jongmin Lee +2
We consider off-policy evaluation (OPE) of deterministic target policies for reinforcement learning (RL) in environments with continuous action spaces. While it is common to use im…