1 paper · 1 filter
Sheila Schoepp, Masoud Jafaripour, Yingyue Cao +6
Reinforcement learning (RL) has shown impressive results in sequential decision-making tasks. Meanwhile, Large Language Models (LLMs) and Vision-Language Models (VLMs) have emerged…