Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
LLMZero: Discovering Adaptive Training Strategies for RL Post-Training via LLM Agents
Haoyang Fang, Wei Zhu, Boran Han +11
RL post-training strategies are dataset-dependent and reveal a recurring empirical pattern: capacity parameters accumulate monotonically across stages, while regularization paramet…
cs.LG2024
An Adaptive Latent Factorization of Tensors Model for Embedding Dynamic Communication Network
Xin Liao, Qicong Hu, Peng Tang
The Dynamic Communication Network (DCN) describes the interactions over time among various communication nodes, and it is widely used in Big-data applications as a data source. As…