3 papers
cs.LG2026
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
Xiaoyun Liu, Divya Saxena, Jiannong Cao +3
Structured pruning is widely applied to compress large language models (LLMs), but its performance depends heavily on how neuron importance is estimated. Most existing methods rely…
cs.LG2024
Overcoming Growth-Induced Forgetting in Task-Agnostic Continual Learning
Yuqing Zhao, Jiannong Cao, Divya Saxena +4
In continual learning (CL), model growth enhances adaptability to new data. However, when model growth is applied improperly, especially in task-agnostic CL, where the entire grown…
cs.CE2024
NASPrecision: Neural Architecture Search-Driven Multi-Stage Learning for Surface Roughness Prediction in Ultra-Precision Machining
Penghui Ruan, Divya Saxena, Jiannong Cao +3
Accurate surface roughness prediction is critical for ensuring high product quality, especially in areas like manufacturing and aerospace, where the smallest imperfections can comp…