1 paper · 1 filter
Sankar Behera, Dhruv Singh, Anshika Agnihotri +3
Structured pruning of large language models (LLMs) offers hardware-efficient compression, yet existing methods require calibration data, gradient computation, or large auxiliary po…