Showing cs.LGShow all
3 papers · 1 filter
cs.LG2026
Parametric Memory Decoding for Zero-Shot Routing in LoRA-Based External Parametric Memory
Fengxian Ji, Zhuohan Xie, Jingpu Yang +3
With the rise of parametric memory, LoRA-based External Parametric Memory (EPM) has emerged as a modular solution, but existing routing methods often introduce additional training,…
cs.LG2026
Distinguishable Deletion: Unifying Knowledge Erasure and Refusal for Large Language Model Unlearning
Puning Yang, Junchi Yu, Qizhou Wang +3
Mitigating sensitive and harmful outputs is fundamental to ensuring safe deployment of LLMs. Existing approaches typically follow two paradigms: Knowledge Deletion (KD), which eras…
cs.LG2025
Divide-Fuse-Conquer: Eliciting "Aha Moments" in Multi-Scenario Games
Xiaoqing Zhang, Huabin Zheng, Ang Lv +5
Large language models (LLMs) have been observed to suddenly exhibit advanced reasoning abilities during reinforcement learning (RL), resembling an ``aha moment'' triggered by simpl…