Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
Mechanism-Driven Monitors for Preemptive Detection of LLM Training Instability
Ruixuan Huang, Hantao Huang, Yifan Huang +3
Frontier large language model training consumes massive accelerator fleets and long wall-clock computation, making stability failures costly when they occur. After a numerical or a…
cs.CL2025
SQ-format: A Unified Sparse-Quantized Hardware-friendly Data Format for LLMs
Ruixuan Huang, Hao Zeng, Hantao Huang +4
Post-training quantization (PTQ) plays a crucial role in the democratization of large language models (LLMs). However, existing low-bit quantization and sparsification techniques a…