1 paper
Chengting Yu, Fengzhao Zhang, Hanzhi Ma +2
Traditional end-to-end (E2E) training of deep networks necessitates storing intermediate activations for back-propagation, resulting in a large memory footprint on GPUs and restric…