1 paper · 1 filter
Ryan Lucas, Kayhan Behdin, Zhipeng Wang +3
Reasoning language models such as DeepSeek-R1 produce long chain-of-thought traces during inference time which make them costly to deploy at scale. We show that using compression t…