NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (39)

cs.LG2026

EvoLP: Self-Evolving Latency Predictor for Model Compression in Real-Time Edge Systems

Shuo Huai, Hao Kong, Shiqing Li +5

cs.AI2026

Can Agents Price a Reaction? Evaluating LLMs on Chemical Cost Reasoning

Yuyang Wu, Yue Huang, Shuaike Shen +8

cs.AI2025

Reasoning Path and Latent State Analysis for Multi-view Visual Spatial Reasoning: A Cognitive Science Perspective

Qiyao Xue, Weichen Liu, Shiqi Wang +3

cs.AR2020

ArSMART: An Improved SMART NoC Design Supporting Arbitrary-Turn Transmission

Hui Chen, Peng Chen, Jun Zhou +2

cs.CL2026

Divide and Conquer: Accelerating Diffusion-Based Large Language Models via Adaptive Parallel Decoding

Xiangzhong Luo, Yilin An, Zhicheng Yu +2

cs.CV2025

ProGait: A Multi-Purpose Video Dataset and Benchmark for Transfemoral Prosthesis Users

Xiangyu Yin, Boyuan Yang, Weichen Liu +4

cs.AR2025

Learning Cache Coherence Traffic for NoC Routing Design

Guochu Xiong, Xiangzhong Luo, Weichen Liu

cs.AI2026

CLORE: Content-Level Optimization for Reasoning Efficiency

Yuyang Wu, Qiyao Xue, Guanxing Lu +4

cs.DC2026

Mapping Without Graphs: Learning Coherence Traffic for Task Placement

Guochu Xiong, Tianrui Ma, Weichen Liu

cs.CV2026

EdgeCompress: Coupling Multidimensional Model Compression and Dynamic Inference for EdgeAI

Hao Kong, Di Liu, Shuo Huai +5

cs.CV2026

MosaicThinker: On-Device Visual Spatial Reasoning for Embodied AI via Iterative Construction of Space Representation

Haoming Wang, Qiyao Xue, Weichen Liu +1

cs.AI2025

Spatial Reasoning in Multimodal Large Language Models: A Survey of Tasks, Benchmarks and Methods

Weichen Liu, Qiyao Xue, Haoming Wang +3

cs.LG2026

Collate: Collaborative Neural Network Learning for Latency-Critical Edge Systems

Shuo Huai, Di Liu, Hao Kong +5

cs.CV2020

Cross-filter compression for CNN inference acceleration

Fuyuan Lyu, Shien Zhu, Weichen Liu

cs.GR2024

Virtual Psychedelia

Jacob Yenney, Weichen Liu, Ying C. Wu

cs.DC2020

On the Analysis of Parallel Real-Time Tasks with Spin Locks

Xu Jiang, Nan Guan, He Du +2

cs.LG2021

HSCoNAS: Hardware-Software Co-Design of Efficient DNNs via Neural Architecture Search

Xiangzhong Luo, Di Liu, Shuo Huai +1

cs.AR2026

CRIMP: Compact & Reliable DNN Inference on In-Memory Processing via Crossbar-Aligned Compression and Non-ideality Adaptation

Shuo Huai, Hao Kong, Xiangzhong Luo +5

cs.LG2020

Bringing AI To Edge: From Deep Learning's Perspective

Di Liu, Hao Kong, Xiangzhong Luo +2

cs.DC2025

Coherence-Aware Task Graph Modeling for Realistic Application

Guochu Xiong, Xiangzhong Luo, Weichen Liu

cs.AR2022

FAT: An In-Memory Accelerator with Fast Addition for Ternary Weight Neural Networks

Shien Zhu, Luan H. K. Duong, Hui Chen +2

cs.CV2026

Smart Scissor: Coupling Spatial Redundancy Reduction and CNN Compression for Embedded Hardware

Hao Kong, Di Liu, Shuo Huai +5

cs.LG2026

Latency-Constrained DNN Architecture Learning for Edge Systems using Zerorized Batch Normalization

Shuo Huai, Di Liu, Hao Kong +4

cs.AR2026

On Hardware-Aware Design and Optimization of Edge Intelligence

Shuo Huai, Hao Kong, Xiangzhong Luo +5

cs.CV2026

Towards Efficient Convolutional Neural Network for Embedded Hardware via Multi-Dimensional Pruning

Hao Kong, Di Liu, Xiangzhong Luo +5

The paper introduces TECO, a framework that jointly prunes depth, width, and input resolution of convolutional neural networks to improve speed and resource usage on embedded devic…

#model compression#pruning#embedded hardware#convolutional neural networks
eess.SP2020

MindReading: An Ultra-Low-Power Photonic Accelerator for EEG-based Human Intention Recognition

Qian Lou, Wenyang Liu, Weichen Liu +2

cs.MM2022

A DirectX-Based DICOM Viewer for Multi-User Surgical Planning in Augmented Reality

Menghe Zhang, Weichen Liu, Nadir Weibel +1

cs.CV2026

FedTR: Federated Learning Framework with Transfer Learning for Industrial Visual Inspection

Vikash Sathiamoorthy, Shuo Huai, Hao Kong +7

cs.LG2022

You Only Search Once: On Lightweight Differentiable Architecture Search for Resource-Constrained Embedded Platforms

Xiangzhong Luo, Di Liu, Hao Kong +3

cs.OH2018

CrowdExpress: A Probabilistic Framework for On-Time Crowdsourced Package Deliveries

Chao Chen, Sen Yang, Weichen Liu +3

cs.CV2026

IdentiFace: Multi-Modal Iterative Diffusion Framework for Identifiable Suspect Face Generation in Crime Investigations

Weichen Liu, Yixin Yang, Changsheng Chen +1

cs.LG2025

Exploring Deep-to-Shallow Transformable Neural Networks for Intelligent Embedded Systems

Xiangzhong Luo, Weichen Liu

cs.HC2024

Launching Your VR Neuroscience Laboratory

Ying Choon Wu, Christopher Maymon, Jonathon Paden +1

cs.DC2018

Response Time Bounds for Typed DAG Parallel Tasks on Heterogeneous Multi-cores

Meiling Han, Nan Guan, Jinghao Sun +3

cs.LG2026

BitsMoE: Efficient Spectral Energy-Guided Bit Allocation for MoE LLM Quantization

Jiayu Zhao, Zihan Teng, Minhao Fan +4

cs.DC2026

Coherence in Control: Bridging Many-Core Mapping and Routing through Cost Unification

Guochu Xiong, Xiangzhong Luo, Weichen Liu

cs.AI2024

Enabling Energy-Efficient Deployment of Large Language Models on Memristor Crossbar: A Synergy of Large and Small

Zhehui Wang, Tao Luo, Cheng Liu +3

cs.LG2025

Efficient Deep Learning Infrastructures for Embedded Computing Systems: A Comprehensive Survey and Future Envision

Xiangzhong Luo, Di Liu, Hao Kong +4

cs.HC2025

DriveSimQuest: A VR Driving Simulator and Research Platform on Meta Quest with Unity

Nishanth Chidambaram, Weichen Liu, Manas Satish Bedmutha +2