1 paper
Pan Wang, Yihao Hu, Xiujin Liu +3
Vision-language model (VLM) agents increasingly rely on memory-augmented reinforcement learning to reuse experience across long-horizon tasks, yet most existing frameworks store me…