2 papers
cs.DC2026
Joint Training on AMD and NVIDIA GPUs
Jon Hu, Thomas Jia, Jing Zhu +1
As large language models continue to scale, training demands on compute and system capacity grow rapidly, making single-vendor homogeneous clusters insufficient. This paper present…
cs.CV2025
Precision Neural Network Quantization via Learnable Adaptive Modules
Wenqiang Zhou, Zhendong Yu, Xinyu Liu +5
Quantization Aware Training (QAT) is a neural network quantization technique that compresses model size and improves operational efficiency while effectively maintaining model perf…