From the 1 of 2 linked papers with an AI index.
2 papers
cs.LG2026
Do You Really Need to Pretrain Q-Functions for Online RL Fine-Tuning?
Perry Dong, Ron Polonsky, Dorsa Sadigh +2
The paper investigates whether pretraining Q-functions is beneficial when fine‑tuning a pretrained policy in online reinforcement learning, finding that naive Q‑function pretrainin…
cs.CL2026
Document Optimization for Black-Box Retrieval via Reinforcement Learning
Omri Uzan, Ron Polonsky, Douwe Kiela +1
Document expansion is a classical technique for improving retrieval quality, and is attractive since it shifts computation offline, avoiding additional query-time processing. Howev…