Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Episodic Memory Temporal Consistency for Cooperative Multi-Agent Reinforcement Learning
Zicheng Zhao, Yu Lan, Chengzhengxu Li +2
Cooperative Multi-Agent Reinforcement Learning (MARL) frequently suffers from severe reward sparsity and exploration bottlenecks. While episodic memory mechanisms mitigate these is…
cs.LG2023
Dialogue for Prompting: a Policy-Gradient-Based Discrete Prompt Generation for Few-shot Learning
Chengzhengxu Li, Xiaoming Liu, Yichen Wang +3
Prompt-based pre-trained language models (PLMs) paradigm have succeeded substantially in few-shot natural language processing (NLP) tasks. However, prior discrete prompt optimizati…