activity
20242026
most citedNEZHA: A Zero-sacrifice and Hyperspeed Decoding Architecture for Generative Recommendations

1 citations · 1 across the 13 of their papers we have counts for

collaborators
Showing cs.LGShow all

6 papers · 1 filter

cs.LG2026

BRIDGE: Bridging Reasoning In Distillation Gap Elimination via Structure-Aware Masking

Bowen Yu, Sheng Zhang, Binhao Wang +8

Chain-of-Thought (CoT) reasoning has significantly improved LLMs' mathematical problem-solving capabilities, but distilling such capabilities into smaller models remains challengin…

cs.LG2026

DynamicPTQ: Mitigating Activation Quantization Collapse via Residual-Stream Dynamics

Zimo Zhao, Maolin Wang, Bowen Yu +3

Post-training quantization (PTQ) is essential for efficient large language model inference, but reliably quantizing activations remains challenging when weights, activations, and K…

cs.LG2025

FunReason: Enhancing Large Language Models' Function Calling via Self-Refinement Multiscale Loss and Automated Data Refinement

Bingguang Hao, ZengZhuang Xu, Maolin Wang +9

The integration of large language models (LLMs) with function calling has emerged as a crucial capability for enhancing their practical utility in real-world applications. However,…

cs.LG2025

Reasoning through Exploration: A Reinforcement Learning Framework for Robust Function Calling

Bingguang Hao, Zengzhuang Xu, Maolin Wang +9

The effective training of Large Language Models (LLMs) for function calling faces a critical challenge: balancing exploration of complex reasoning paths with stable policy optimiza…

cs.LG2025

DANCE: Resource-Efficient Neural Architecture Search with Data-Aware and Continuous Adaptation

Maolin Wang, Tianshuo Wei, Sheng Zhang +6

Neural Architecture Search (NAS) has emerged as a powerful approach for automating neural network design. However, existing NAS methods face critical limitations in real-world depl…

cs.LG2025

MetaLoRA: Tensor-Enhanced Adaptive Low-Rank Fine-tuning

Maolin Wang, Xiangyu Zhao

There has been a significant increase in the deployment of neural network models, presenting substantial challenges in model adaptation and fine-tuning. Efficient adaptation is cru…