2 papers
cs.LG2026
RAP: Runtime Adaptive Pruning for LLM Inference
Huanrong Liu, Chunlin Tian, Xuyang Wei +2
Large language models (LLMs) excel at language understanding and generation, but their enormous computational and memory requirements hinder deployment. Compression offers a potent…
cs.CV2025
AsymLoRA: Harmonizing Data Conflicts and Commonalities in MLLMs
Xuyang Wei, Chunlin Tian, Li Li
Effective instruction fine-tuning on diverse image-text datasets is crucial for developing a versatile Multimodal Large Language Model (MLLM), where dataset composition dictates th…