ai4ai 1evolutionary search 1machine learning engineering 1meta-learning 1recursive self-improvement 1reinforcement learning 1
From the 1 of 19 linked papers with an AI index.
Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Nirvana: A Specialized Generalist Model With Task-Aware Memory Mechanism
Yuhua Jiang, Shuang Cheng, Yihao Liu +7
Large Language Models (LLMs) excel at general language tasks but struggle in specialized domains. Specialized Generalist Models (SGMs) address this by preserving broad capabilities…
cs.LG2025
FlowRL: Matching Reward Distributions for LLM Reasoning
Xuekai Zhu, Daixuan Cheng, Dinghuai Zhang +20
We propose FlowRL: matching the full reward distribution via flow balancing instead of maximizing rewards in large language model (LLM) reinforcement learning (RL). Recent advanced…