4 papers · 1 filter
Efficient Dynamic Ensembling for Multiple LLM Experts
Jinwu Hu, Yufeng Wang, Shuhai Zhang +5
LLMs have demonstrated impressive performance across various language tasks. However, the strengths of LLMs can vary due to different architectures, model sizes, areas of training…
Test-Time Model Adaptation for Quantized Neural Networks
Zeshuai Deng, Guohao Chen, Shuaicheng Niu +6
Quantizing deep models prior to deployment is a widely adopted technique to speed up inference for various real-time applications, such as autonomous driving. However, quantized mo…
Core Context Aware Transformers for Long Context Language Modeling
Yaofo Chen, Zeng You, Shuhai Zhang +4
Transformer-based Large Language Models (LLMs) have exhibited remarkable success in extensive tasks primarily attributed to self-attention mechanism, which requires a token to cons…
Deep Electromagnetic Structure Design Under Limited Evaluation Budgets
Shijian Zheng, Fangxiao Jin, Shuhai Zhang +2
Electromagnetic structure (EMS) design plays a critical role in developing advanced antennas and materials, but remains challenging due to high-dimensional design spaces and expens…