Showing cs.LGShow all
3 papers · 1 filter
cs.LG2026
LION-DG: Layer-Informed Initialization with Deep Gradient Protocols for Accelerated Neural Network Training
Hyunjun Kim
Weight initialization remains decisive for neural network optimization, yet existing methods are largely layer-agnostic. We study initialization for deeply-supervised architectures…
cs.LG2026
HOLOGRAPH: Active Causal Discovery via Sheaf-Theoretic Alignment of Large Language Model Priors
Hyunjun Kim
Causal discovery from observational data remains fundamentally limited by identifiability constraints. Recent work has explored leveraging Large Language Models (LLMs) as sources o…
cs.LG2026
Geometric Regularization in Mixture-of-Experts: The Disconnect Between Weights and Activations
Hyunjun Kim
Mixture-of-Experts (MoE) models achieve efficiency through sparse activation, but the role of geometric regularization in expert specialization remains unclear. We apply orthogonal…