papers

Publications (35)

cs.CV2023

DeepMAD: Mathematical Architecture Design for Deep Convolutional Neural Network

Xuan Shen, Yaohua Wang, Ming Lin +4

cs.AI2025

OIDA-QA: A Multimodal Benchmark for Analyzing the Opioid Industry Documents Archive

Xuan Shen, Brian Wingenroth, Zichao Wang +12

cs.CV2025

DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance

Xuan Shen, Chenxia Han, Yufa Zhou +7

cs.AI2024

Search for Efficient Large Language Models

Xuan Shen, Pu Zhao, Yifan Gong +7

cs.CL2026

Open-Source Multimodal Moxin Models with Moxin-VLM and Moxin-VLA

Pu Zhao, Arash Akbari, Xuan Shen +16

cs.CV2025

QuartDepth: Post-Training Quantization for Real-Time Depth Estimation on the Edge

Xuan Shen, Weize Ma, Jing Liu +9

cs.CV2023

Data Level Lottery Ticket Hypothesis for Vision Transformers

Xuan Shen, Zhenglun Kong, Minghai Qin +6

cs.LG2021

NPAS: A Compiler-aware Framework of Unified Network Pruning and Architecture Search for Beyond Real-Time Mobile Acceleration

Zhengang Li, Geng Yuan, Wei Niu +13

cs.LG2025

Squat: Quant Small Language Models on the Edge

Xuan Shen, Peiyan Dong, Zhenglun Kong +9

cs.CL2026

Efficient Reasoning with Hidden Thinking

Xuan Shen, Yizhou Wang, Yufa Zhou +4

cs.LG2021

Improving DNN Fault Tolerance using Weight Pruning and Differential Crossbar Mapping for ReRAM-based Edge AI

Geng Yuan, Zhiheng Liao, Xiaolong Ma +11

cs.CV2025

FastCar: Cache Attentive Replay for Fast Auto-Regressive Video Generation on the Edge

Xuan Shen, Weize Ma, Yufa Zhou +11

cs.CV2022

Real-Time Portrait Stylization on the Edge

Yanyu Li, Xuan Shen, Geng Yuan +5

cs.LG2025

Agile-Quant: Activation-Guided Quantization for Faster Inference of LLMs on the Edge

Xuan Shen, Peiyan Dong, Lei Lu +5

cs.CL2024

A Survey of Small Language Models

Chien Van Nguyen, Xuan Shen, Ryan Aponte +25

cs.CV2022

Peeling the Onion: Hierarchical Reduction of Data Redundancy for Efficient Vision Transformer Training

Zhenglun Kong, Haoyu Ma, Geng Yuan +12

cs.LG2021

Sanity Checks for Lottery Tickets: Does Your Winning Ticket Really Win the Jackpot?

Xiaolong Ma, Geng Yuan, Xuan Shen +8

cond-mat.str-el2012

Magnetic ordering and structural phase transitions in strained ultrathin SrRuO/SrTiO superlattice

Mingqiang Gu, Qiyun Xie, Xuan Shen +6

cs.LG2025

RoRA: Efficient Fine-Tuning of LLM with Reliability Optimization for Rank Adaptation

Jun Liu, Zhenglun Kong, Peiyan Dong +10

cs.LG2025

LazyDiT: Lazy Learning for the Acceleration of Diffusion Transformers

Xuan Shen, Zhao Song, Yufa Zhou +12

cs.LG2024

Rethinking Token Reduction for State Space Models

Zheng Zhan, Yushu Wu, Zhenglun Kong +6

cs.CV2022

SPViT: Enabling Faster Vision Transformers via Soft Token Pruning

Zhenglun Kong, Peiyan Dong, Xiaolong Ma +9

cs.CV2025

TSLA: A Task-Specific Learning Adaptation for Semantic Segmentation on Autonomous Vehicles Platform

Jun Liu, Zhenglun Kong, Pu Zhao +9

cs.CR2026

SeClaw: Spec-Driven Security Task Synthesis for Evaluating Autonomous Agents

Hao Cheng, Changtao Miao, Tianle Song +21

cs.CL2025

7B Fully Open Source Moxin-LLM/VLM -- From Pretraining to GRPO-based Reinforcement Learning Enhancement

Pu Zhao, Xuan Shen, Zhenglun Kong +16

cs.CL2025

Enabling Flexible Multi-LLM Integration for Scalable Knowledge Aggregation

Zhenglun Kong, Zheng Zhan, Shiyue Hou +10

cs.CV2024

AyE-Edge: Automated Deployment Space Search Empowering Accuracy yet Efficient Real-Time Object Detection on the Edge

Chao Wu, Yifan Gong, Liangkai Liu +7

cs.LG2021

Lottery Ticket Preserves Weight Correlation: Is It Desirable or Not?

Ning Liu, Geng Yuan, Zhengping Che +7

cs.CV2021

Towards Fast and Accurate Multi-Person Pose Estimation on Mobile Devices

Xuan Shen, Geng Yuan, Wei Niu +5

cs.LG2024

Numerical Pruning for Efficient Autoregressive Models

Xuan Shen, Zhao Song, Yufa Zhou +12

cs.CV2024

Exploring Token Pruning in Vision State Space Models

Zheng Zhan, Zhenglun Kong, Yifan Gong +8

cs.RO2026

When Should a Robot Think? Resource-Aware Reasoning via Reinforcement Learning for Embodied Robotic Decision-Making

Jun Liu, Pu Zhao, Zhenglun Kong +12

cs.LG2024

Pruning Foundation Models for High Accuracy without Retraining

Pu Zhao, Fei Sun, Xuan Shen +4

cs.CL2026

Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment

Jun Liu, Zhenglun Kong, Pu Zhao +9

cs.CV2026

ScAle: Attention Head Scaling as a Minimal Adapter for Spatial Reasoning in Vision Language Models

Rahul Chowdhury, Timothy A Rupprecht, Xuan Shen +2