NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (103)

cs.NI2016

Dynamic Virtual Machine Management via Approximate Markov Decision Process

Zhenhua Han, Haisheng Tan, Guihai Chen +3

cs.LG2026

You Need an Encoder for Native Position-Independent Caching

Shiju Zhao, Junhao Hu, Jiaqi Zheng +1

cs.CL2025

RAGRouter: Learning to Route Queries to Multiple Retrieval-Augmented Language Models

Jiarui Zhang, Xiangyu Liu, Yong Hu +3

cs.IR2022

Trading Hard Negatives and True Negatives: A Debiased Contrastive Collaborative Filtering Approach

Chenxiao Yang, Qitian Wu, Jipeng Jin +3

cs.LG2025

TokenFlow: Responsive LLM Text Streaming Serving under Request Burst via Preemptive Scheduling

Junyi Chen, Chuheng Du, Renyuan Liu +6

cs.IR2019

Dual Graph Attention Networks for Deep Latent Representation of Multifaceted Social Effects in Recommender Systems

Qitian Wu, Hengrui Zhang, Xiaofeng Gao +4

cs.GT2026

Guiding the Recommender: Information-Aware Auto-Bidding for Content Promotion

Yumou Liu, Zhenzhe Zheng, Jiang Rong +3

cs.LG2017

Accelerate RNN-based Training with Importance Sampling

Fei Wang, Xiaofeng Gao, Guihai Chen +1

cs.LG2025

PAF-Net: Phase-Aligned Frequency Decoupling Network for Multi-Process Manufacturing Quality Prediction

Yang Luo, Haoyang Luan, Haoyun Pan +3

cs.SI2020

Neighborhood Matters: Influence Maximization in Social Networks with Limited Access

Chen Feng, Luoyi Fu, Bo Jiang +4

cs.LG2023

Federated Submodel Optimization for Hot and Cold Data Features

Yucheng Ding, Chaoyue Niu, Fan Wu +4

cs.LG2022

ALT: Boosting Deep Learning Performance by Breaking the Wall between Graph and Operator Level Optimizations

Zhiying Xu, Jiafan Xu, Hongding Peng +8

cs.LG2025

Revisiting Service Level Objectives and System Level Metrics in Large Language Model Serving

Zhibin Wang, Shipeng Li, Yuhang Zhou +7

cs.AI2026

AdaFuse: Accelerating Dynamic Adapter Inference via Token-Level Pre-Gating and Fused Kernel Optimization

Qiyang Li, Rui Kong, Yuchen Li +5

cs.LG2023

ECLM: Efficient Edge-Cloud Collaborative Learning with Continuous Environment Adaptation

Yan Zhuang, Zhenzhe Zheng, Yunfeng Shao +3

cs.GT2023

Mechanism Design with Predicted Task Revenue for Bike Sharing Systems

Hongtao Lv, Chaoli Zhang, Zhenzhe Zheng +3

cs.CV2026

CaT-GS: Efficient 3DGS Rendering for Large Scale Scenes via Inter-frame Caching and Tile Scheduling

Tingjia Zhang, Bo Chen, Shengzhong Liu +2

cs.MM2025

ABO: Abandon Bayer Filter for Adaptive Edge Offloading in Responsive Augmented Reality

Yongxuan Han, Shengzhong Liu, Fan Wu +1

cs.CV2022

One-Time Model Adaptation to Heterogeneous Clients: An Intra-Client and Inter-Image Attention Design

Yikai Yan, Chaoyue Niu, Fan Wu +4

cs.LG2024

Delta: A Cloud-assisted Data Enrichment Framework for On-Device Continual Learning

Chen Gong, Zhenzhe Zheng, Fan Wu +2

cs.LG2025

Efficient Distributed Retrieval-Augmented Generation for Enhancing Language Model Performance

Shangyu Liu, Zhenzhe Zheng, Xiaoyao Huang +3

stat.ML2020

Distributed Non-Convex Optimization with Sublinear Speedup under Intermittent Client Availability

Yikai Yan, Chaoyue Niu, Yucheng Ding +5

cs.SI2019

A Hierarchical Optimizer for Recommendation System Based on Shortest Path Algorithm

Jiacheng Dai, Zhifeng Jia, Xiaofeng Gao +1

cs.LG2021

From Server-Based to Client-Based Machine Learning: A Comprehensive Survey

Renjie Gu, Chaoyue Niu, Fan Wu +4

cs.LG2022

Walle: An End-to-End, General-Purpose, and Large-Scale Production System for Device-Cloud Collaborative Machine Learning

Chengfei Lv, Chaoyue Niu, Renjie Gu +17

cs.CV2025

Image Super-Resolution with Text Prompt Diffusion

Zheng Chen, Yulun Zhang, Jinjin Gu +4

cs.GT2018

ERA: Towards Privacy Preservation and Verifiability for Online Ad Exchanges

Chaoyue Niu, Minping Zhou, Zhenzhe Zheng +2

cs.CC2014

Online Vector Scheduling and Generalized Load Balancing

Xiaojun Zhu, Qun Li, Weizhen Mao +1

cs.CV2026

Not All Pixels Are Equal: Pixel-wise Meta-Learning for Medical Segmentation with Noisy Labels

Chenyu Mu, Guihai Chen, Xun Yang +2

cs.LG2025

Symmetry-Preserving Architecture for Multi-NUMA Environments (SPANE): A Deep Reinforcement Learning Approach for Dynamic VM Scheduling

Tin Ping Chan, Yunlong Cheng, Yizhan Zhu +2

cs.LG2025

MPIC: Position-Independent Multimodal Context Caching System for Efficient MLLM Serving

Shiju Zhao, Junhao Hu, Rongxiao Huang +2

cs.CL2024

Fast Chain-of-Thought: A Glance of Future from Parallel Decoding Leads to Answers Faster

Hongxuan Zhang, Zhining Liu, Yao Zhao +4

cs.IR2022

HIEN: Hierarchical Intention Embedding Network for Click-Through Rate Prediction

Zuowu Zheng, Changwang Zhang, Xiaofeng Gao +1

cs.LG2024

Adaptive Two-Stage Cloud Resource Scaling via Hierarchical Multi-Indicator Forecasting and Bayesian Decision-Making

Yang Luo, Shiyu Wang, Zhemeng Yu +4

cs.LG2025

Scaling Graph Chain-of-Thought Reasoning: A Multi-Agent Framework with Efficient LLM Serving

Chengying Huan, Ziheng Meng, Yongchao Liu +11

cs.GT2023

Truthful Auctions for Automated Bidding in Online Advertising

Yidan Xing, Zhilin Zhang, Zhenzhe Zheng +4

cs.NI2013

Minimum Latency Broadcast Scheduling in Single-Radio Multi-Channel Wireless Ad-Hoc Networks

Lizhao You, Zimu Yuan, Bin Tang +1

cs.DC2026

Scalable LLM Agent Tool Access in the Cloud

Mingxin Li, Enge Song, Yueshang Zuo +27

cs.CR2026

An Efficient and Privacy-Preserving Architecture for Cross-Institutional Collaborative RAG

Chenxin Mao, Shangyu Liu, Zhenzhe Zheng +3

cs.CL2026

Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models

Hang Zeng, Xiangyu Liu, Yong Hu +5

cs.DC2026

SmartSwap: Swap-Based Memory Optimization for LLM Training under Varying Operator Sequences

Zibo Wang, Yuhang Zhou, Zhibin Wang +13

The paper introduces SmartSwap, a swap‑based memory optimization framework that adapts to varying operator sequences in eager‑mode training of large language models, using a lightw…

#memory optimization#large language model training#swap-based management#eager execution
cs.LG2023

To Store or Not? Online Data Selection for Federated Learning with Limited Storage

Chen Gong, Zhenzhe Zheng, Yunfeng Shao +3

cs.LG2025

Bi-Level Decision-Focused Causal Learning for Large-Scale Marketing Optimization: Bridging Observational and Experimental Data

Shuli Zhang, Hao Zhou, Jiaqi Zheng +4

cs.AI2022

MoTiAC: Multi-Objective Actor-Critics for Real-Time Bidding

Haolin Zhou, Chaoqi Yang, Xiaofeng Gao +3

cs.DC2026

TIDE-MC: Two-Sided Interpolative Decomposition for Billion-Scale GPU Matrix Completion

Chengying Huan, Yubo Wang, Pinhuan Wang +11

cs.LG2019

Secure Federated Submodel Learning

Chaoyue Niu, Fan Wu, Shaojie Tang +5

cs.DB2018

Achieving Data Truthfulness and Privacy Preservation in Data Markets

Chaoyue Niu, Zhenzhe Zheng, Fan Wu +2

cs.LG2024

Vertical Federated Learning: Challenges, Methodologies and Experiments

Kang Wei, Jun Li, Chuan Ma +5

cs.DC2018

IS-ASGD: Accelerating Asynchronous SGD using Importance Sampling

Fei Wang, Jun Ye, Weichen Li +1

cs.IR2022

Cross-Task Knowledge Distillation in Multi-Task Recommendation

Chenxiao Yang, Junwei Pan, Xiaofeng Gao +3

cs.CL2026

C$^2$KV: Compressed and Composable KV Cache Reuse for Efficient LLM Inference

Chuheng Du, Junyi Chen, Hanlin Tang +7

cs.NI2026

AnyPro: Preference-Preserving Anycast Optimization based on Strategic AS-Path Prepending

Minyuan Zhou, Yuning Chen, Jiaqi Zheng +11

cs.LG2025

Reinfier and Reintrainer: Verification and Interpretation-Driven Safe Deep Reinforcement Learning Frameworks

Zixuan Yang, Jiaqi Zheng, Guihai Chen

cs.CV2025

Responsive DNN Adaptation for Video Analytics against Environment Shift via Hierarchical Mobile-Cloud Collaborations

Maozhe Zhao, Shengzhong Liu, Fan Wu +1

cs.IR2022

AutoAttention: Automatic Field Pair Selection for Attention in User Behavior Modeling

Zuowu Zheng, Xiaofeng Gao, Junwei Pan +4

cs.LG2022

On-Device Learning with Cloud-Coordinated Data Augmentation for Extreme Model Personalization in Recommender Systems

Renjie Gu, Chaoyue Niu, Yikai Yan +5

cs.CL2026

SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning

Chenzhi Hu, Qinzhe Hu, Yuhang Xu +6

cs.IR2017

DancingLines: An Analytical Scheme to Depict Cross-Platform Event Popularity

Tianxiang Gao, Weiming Bao, Jinning Li +5

cs.CL2025

CORE: Reducing UI Exposure in Mobile Agents via Collaboration Between Cloud and Local LLMs

Gucongcong Fan, Chaoyue Niu, Chengfei Lyu +2

cs.LG2025

Low-bit Model Quantization for Deep Neural Networks: A Survey

Kai Liu, Qian Zheng, Kaiwen Tao +9

cs.LG2025

Personalized Language Model Learning on Text Data Without User Identifiers

Yucheng Ding, Yangwenjian Tan, Xiangyu Liu +6

cs.CV2025

QuantFace: Efficient Quantization for Face Restoration

Jiatong Li, Libo Zhu, Haotong Qin +5

cs.DS2022

QDR-Tree: An Efficient Index Scheme for Complex Spatial Keyword Query

Xinshi Zang, Peiwen Hao, Xiaofeng Gao +2

cs.LG2019

Learning Latent Process from High-Dimensional Event Sequences via Efficient Sampling

Qitian Wu, Zixuan Zhang, Xiaofeng Gao +2

cs.DB2026

OrchANN: Hierarchical Orchestration for Skewed Out-of-Core Vector Search

Lizheng Chen, Pinhuan Wang, Shaonan Ma +9

cs.IR2024

Temporal Interest Network for User Response Prediction

Haolin Zhou, Junwei Pan, Xinyi Zhou +4

cs.IR2022

On-Device Model Fine-Tuning with Label Correction in Recommender Systems

Yucheng Ding, Chaoyue Niu, Fan Wu +3

cs.DC2026

Gleam: Adaptive Network-Efficient CUDA API Remoting for Cross-Device GPU Sharing over LANs

Zhihao Xu, Hao Zhong, Zeting Zhou +9

cs.IR2018

Fine-Grained User Profiling for Personalized Task Matching in Mobile Crowdsensing

Shuo Yang, Zhenzhe Zheng, Shaojie Tang +2

cs.SI2022

NETR-Tree: An Eifficient Framework for Social-Based Time-Aware Spatial Keyword Query

Xiuqi Huang, Yuanning Gao, Xiaofeng Gao +1

cs.CV2025

Empower Vision Applications with LoRA LMM

Liang Mi, Weijun Wang, Wenming Tu +10

cs.LG2025

ConfClip: Confidence-Weighted and Clipped Reward for Reinforcement Learning in LLMs

Bonan Zhang, Zhongqi Chen, Bowen Song +3

cs.MA2022

A Cooperative-Competitive Multi-Agent Framework for Auto-bidding in Online Advertising

Chao Wen, Miao Xu, Zhilin Zhang +12

cs.LG2020

Distributed Optimization over Block-Cyclic Data

Yucheng Ding, Chaoyue Niu, Yikai Yan +5

cs.IR2024

Generative Pre-trained Ranking Model with Over-parameterization at Web-Scale (Extended Abstract)

Yuchen Li, Haoyi Xiong, Linghe Kong +4

cs.CL2025

Automated Privacy Information Annotation in Large Language Model Interactions

Hang Zeng, Xiangyu Liu, Yong Hu +4

cs.LG2023

DC-CCL: Device-Cloud Collaborative Controlled Learning for Large Vision Models

Yucheng Ding, Chaoyue Niu, Fan Wu +3

cs.OS2025

MNN-AECS: Energy Optimization for LLM Decoding on Mobile Devices via Adaptive Core Selection

Zhengxiang Huang, Chaoyue Niu, Zhaode Wang +8

cs.DC2026

UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods

Yipeng Liu, Chang Liu, Si Shen +16

cs.CL2025

Pre$^3$: Enabling Deterministic Pushdown Automata for Faster Structured LLM Generation

Junyi Chen, Shihao Bai, Zaijun Wang +7

cs.LG2026

Optimizing Feature Extraction for On-device Model Inference with User Behavior Sequences

Chen Gong, Zhenzhe Zheng, Yiliu Chen +3

cs.NI2020

UAVs as a Service: Boosting Edge Intelligence for Air-Ground Integrated Networks

Chao Dong, Yun Shen, Yuben Qu +3

cs.LG2021

Toward Understanding the Influence of Individual Clients in Federated Learning

Yihao Xue, Chaoyue Niu, Zhenzhe Zheng +4

cs.LG2026

BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning

Yuhang Xu, Kaibin Tian, Yang Tian +6

cs.DC2026

FlexSpec: Frozen Drafts Meet Evolving Targets in Edge-Cloud Collaborative LLM Speculative Decoding

Yuchen Li, Rui Kong, Zhonghao Lyu +11

cs.DB2021

Hash Adaptive Bloom Filter

Rongbiao Xie, Meng Li, Zheyu Miao +4

cs.IR2017

Which is better? A Modularized Evaluation for Topic Popularity Prediction

Yiming Zhang, Jiacheng Luo, Xiaofeng Gao +1

eess.IV2024

2DQuant: Low-bit Post-Training Quantization for Image Super-Resolution

Kai Liu, Haotong Qin, Yong Guo +4

cs.LG2026

CoDec: Prefix-Shared Decoding Kernel for LLMs

Zhibin Wang, Rui Ning, Chao Fang +12

cs.LG2025

Optimizing Storage Overhead of User Behavior Log for ML-embedded Mobile Apps

Chen Gong, Yan Zhuang, Zhenzhe Zheng +4

cs.CL2025

Personalized LLM for Generating Customized Responses to the Same Query from Different Users

Hang Zeng, Chaoyue Niu, Fan Wu +2

cs.CL2024

CSR:Achieving 1 Bit Key-Value Cache via Sparse Representation

Hongxuan Zhang, Yao Zhao, Jiaqi Zheng +3

cs.SI2022

FastCover: An Unsupervised Learning Framework for Multi-Hop Influence Maximization in Social Networks

Runbo Ni, Xueyan Li, Fangqi Li +2

cs.CV2025

Adaptive Routing of Text-to-Image Generation Requests Between Large Cloud Model and Light-Weight Edge Model

Zewei Xin, Qinya Li, Chaoyue Niu +2

cs.SI2019

Evolving Influence Maximization in Evolving Networks

Xudong Wu, Luoyi Fu, Zixin Zhang +3

cs.CL2026

From Myopic Selection to Long-Horizon Awareness: Sequential LLM Routing for Multi-Turn Dialogue

Jiarui Zhang, Xiangyu Liu, Yong Hu +5

cs.OS2025

Nova: Real-Time Agentic Vision-Language Model Serving with Adaptive Cross-Stage Parallelization

Yuhang Xu, Shengzhong Liu, Dong Zhang +3

cs.CE2019

Online Pricing with Reserve Price Constraint for Personal Data Markets

Chaoyue Niu, Zhenzhe Zheng, Fan Wu +2

cs.CV2025

Improving SAM for Camouflaged Object Detection via Dual Stream Adapters

Jiaming Liu, Linghe Kong, Guihai Chen

cs.LG2025

Collaborative Learning of On-Device Small Model and Cloud-Based Large Model: Advances and Future Directions

Chaoyue Niu, Yucheng Ding, Junhui Lu +7