4 papers
SkillSight: Calibrating Generic Content Bias for Skill Retrieval
Jinying Xiao, Bin Li, Bin Ji +9
As large language model agents gain access to increasingly large skill libraries, retrieving the right skill becomes critical to reliable capability selection and execution. Existi…
Outlier Smoothing with Closed-Form Rotations for W4A4 Large Language Model Quantization
Jinying Xiao, Bin Ji, Shasha Li +8
Large Language Models (LLMs) quantization facilitates deploying LLMs in resource-limited settings, but existing methods that combine incompatible gradient optimization and quantiza…
Rethinking Residual Distribution in Locate-then-Edit Model Editing
Xiaopeng Li, Shanwen Wang, Shasha Li +4
Model editing enables targeted updates to the knowledge of large language models (LLMs) with minimal retraining. Among existing approaches, locate-then-edit methods constitute a pr…
Camel: Energy-Aware LLM Inference on Resource-Constrained Devices
Hao Xu, Long Peng, Shezheng Song +5
Most Large Language Models (LLMs) are currently deployed in the cloud, with users relying on internet connectivity for access. However, this paradigm faces challenges such as netwo…