1 paper
Boyu Shi, Chang Liu, ChuanBao Gao +2
Layer pruning efficiently reduces Large Language Model (LLM) computational costs but often triggers sudden performance collapse. Existing representation-based analyses struggle to…