3 papers
cs.CL2026
ACTD: Anchor-Based Cross-Tokenizer Distillation with Residual Regularization
Huiyi Zhang, Zijian Li, Xiaocheng Feng +4
Knowledge distillation effectively transfers reasoning capabilities from large language models to lightweight student models. To enable knowledge transfer across disparate model fa…
cs.CL2025
FroM: Frobenius Norm-Based Data-Free Adaptive Model Merging
Zijian Li, Xiaocheng Feng, Huixin Liu +3
With the development of large language models, fine-tuning has emerged as an effective method to enhance performance in specific scenarios by injecting domain-specific knowledge. I…
cs.CL2023
Knowledge-tuning Large Language Models with Structured Medical Knowledge Bases for Reliable Response Generation in Chinese
Haochun Wang, Sendong Zhao, Zewen Qiang +9
Large Language Models (LLMs) have demonstrated remarkable success in diverse natural language processing (NLP) tasks in general domains. However, LLMs sometimes generate responses…