Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Chasing Moving Targets with Online Self-Play Reinforcement Learning for Safer Language Models
Mickel Liu, Liwei Jiang, Yancheng Liang +4
Conventional large language model (LLM) safety alignment relies on a reactive, disjoint loop: attackers exploit a static model, then defenders patch exposed vulnerabilities. This s…
cs.LG2026
FeDMRA: Federated Incremental Learning with Dynamic Memory Replay Allocation
Tiantian Wang, Xiang Xiang, Simon S. Du
In federated healthcare systems, Federated Class-Incremental Learning (FCIL) has emerged as a key paradigm, enabling continuous adaptive model learning among distributed clients wh…