Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
SimMerge: Learning to Select Merge Operators from Similarity Signals
Oliver Bolton, Aakanksha, Arash Ahmadian +3
Model merging combines multiple models into a single model with aggregated capabilities, making it a powerful tool for large language model (LLM) development. However, scaling mode…
cs.LG2020
Robustifying Reinforcement Learning Agents via Action Space Adversarial Training
Kai Liang Tan, Yasaman Esfandiari, Xian Yeow Lee +2
Adoption of machine learning (ML)-enabled cyber-physical systems (CPS) are becoming prevalent in various sectors of modern society such as transportation, industrial, and power gri…