2 papers
cs.CL2026
The Tell-Tale Norm: Magnitude as a Signal for Reasoning Dynamics in Large Language Models
Jinyang Zhang, Hongxin Ding, Yue Fang +4
Recent work has sought to understand Large Language Models (LLMs) reasoning, yet a principled, model-intrinsic signal that captures its layer-wise reasoning dynamics remains undere…
cs.LG2025
ADEPT: Continual Pretraining via Adaptive Expansion and Dynamic Decoupled Tuning
Jinyang Zhang, Yue Fang, Hongxin Ding +5
Conventional continual pretraining (CPT) for large language model (LLM) domain adaptation often suffers from catastrophic forgetting and limited domain capacity. Existing strategie…