Publications (39)
EvoLP: Self-Evolving Latency Predictor for Model Compression in Real-Time Edge Systems
Shuo Huai, Hao Kong, Shiqing Li +5
Can Agents Price a Reaction? Evaluating LLMs on Chemical Cost Reasoning
Yuyang Wu, Yue Huang, Shuaike Shen +8
Reasoning Path and Latent State Analysis for Multi-view Visual Spatial Reasoning: A Cognitive Science Perspective
Qiyao Xue, Weichen Liu, Shiqi Wang +3
ArSMART: An Improved SMART NoC Design Supporting Arbitrary-Turn Transmission
Hui Chen, Peng Chen, Jun Zhou +2
Divide and Conquer: Accelerating Diffusion-Based Large Language Models via Adaptive Parallel Decoding
Xiangzhong Luo, Yilin An, Zhicheng Yu +2
ProGait: A Multi-Purpose Video Dataset and Benchmark for Transfemoral Prosthesis Users
Xiangyu Yin, Boyuan Yang, Weichen Liu +4
Learning Cache Coherence Traffic for NoC Routing Design
Guochu Xiong, Xiangzhong Luo, Weichen Liu
CLORE: Content-Level Optimization for Reasoning Efficiency
Yuyang Wu, Qiyao Xue, Guanxing Lu +4
Mapping Without Graphs: Learning Coherence Traffic for Task Placement
Guochu Xiong, Tianrui Ma, Weichen Liu
EdgeCompress: Coupling Multidimensional Model Compression and Dynamic Inference for EdgeAI
Hao Kong, Di Liu, Shuo Huai +5
MosaicThinker: On-Device Visual Spatial Reasoning for Embodied AI via Iterative Construction of Space Representation
Haoming Wang, Qiyao Xue, Weichen Liu +1
Spatial Reasoning in Multimodal Large Language Models: A Survey of Tasks, Benchmarks and Methods
Weichen Liu, Qiyao Xue, Haoming Wang +3
Collate: Collaborative Neural Network Learning for Latency-Critical Edge Systems
Shuo Huai, Di Liu, Hao Kong +5
Cross-filter compression for CNN inference acceleration
Fuyuan Lyu, Shien Zhu, Weichen Liu
Virtual Psychedelia
Jacob Yenney, Weichen Liu, Ying C. Wu
On the Analysis of Parallel Real-Time Tasks with Spin Locks
Xu Jiang, Nan Guan, He Du +2
HSCoNAS: Hardware-Software Co-Design of Efficient DNNs via Neural Architecture Search
Xiangzhong Luo, Di Liu, Shuo Huai +1
CRIMP: Compact & Reliable DNN Inference on In-Memory Processing via Crossbar-Aligned Compression and Non-ideality Adaptation
Shuo Huai, Hao Kong, Xiangzhong Luo +5
Bringing AI To Edge: From Deep Learning's Perspective
Di Liu, Hao Kong, Xiangzhong Luo +2
Coherence-Aware Task Graph Modeling for Realistic Application
Guochu Xiong, Xiangzhong Luo, Weichen Liu
FAT: An In-Memory Accelerator with Fast Addition for Ternary Weight Neural Networks
Shien Zhu, Luan H. K. Duong, Hui Chen +2
Smart Scissor: Coupling Spatial Redundancy Reduction and CNN Compression for Embedded Hardware
Hao Kong, Di Liu, Shuo Huai +5
Latency-Constrained DNN Architecture Learning for Edge Systems using Zerorized Batch Normalization
Shuo Huai, Di Liu, Hao Kong +4
On Hardware-Aware Design and Optimization of Edge Intelligence
Shuo Huai, Hao Kong, Xiangzhong Luo +5
Towards Efficient Convolutional Neural Network for Embedded Hardware via Multi-Dimensional Pruning
Hao Kong, Di Liu, Xiangzhong Luo +5
The paper introduces TECO, a framework that jointly prunes depth, width, and input resolution of convolutional neural networks to improve speed and resource usage on embedded devic…
MindReading: An Ultra-Low-Power Photonic Accelerator for EEG-based Human Intention Recognition
Qian Lou, Wenyang Liu, Weichen Liu +2
A DirectX-Based DICOM Viewer for Multi-User Surgical Planning in Augmented Reality
Menghe Zhang, Weichen Liu, Nadir Weibel +1
FedTR: Federated Learning Framework with Transfer Learning for Industrial Visual Inspection
Vikash Sathiamoorthy, Shuo Huai, Hao Kong +7
You Only Search Once: On Lightweight Differentiable Architecture Search for Resource-Constrained Embedded Platforms
Xiangzhong Luo, Di Liu, Hao Kong +3
CrowdExpress: A Probabilistic Framework for On-Time Crowdsourced Package Deliveries
Chao Chen, Sen Yang, Weichen Liu +3
IdentiFace: Multi-Modal Iterative Diffusion Framework for Identifiable Suspect Face Generation in Crime Investigations
Weichen Liu, Yixin Yang, Changsheng Chen +1
Exploring Deep-to-Shallow Transformable Neural Networks for Intelligent Embedded Systems
Xiangzhong Luo, Weichen Liu
Launching Your VR Neuroscience Laboratory
Ying Choon Wu, Christopher Maymon, Jonathon Paden +1
Response Time Bounds for Typed DAG Parallel Tasks on Heterogeneous Multi-cores
Meiling Han, Nan Guan, Jinghao Sun +3
BitsMoE: Efficient Spectral Energy-Guided Bit Allocation for MoE LLM Quantization
Jiayu Zhao, Zihan Teng, Minhao Fan +4
Coherence in Control: Bridging Many-Core Mapping and Routing through Cost Unification
Guochu Xiong, Xiangzhong Luo, Weichen Liu
Enabling Energy-Efficient Deployment of Large Language Models on Memristor Crossbar: A Synergy of Large and Small
Zhehui Wang, Tao Luo, Cheng Liu +3
Efficient Deep Learning Infrastructures for Embedded Computing Systems: A Comprehensive Survey and Future Envision
Xiangzhong Luo, Di Liu, Hao Kong +4
DriveSimQuest: A VR Driving Simulator and Research Platform on Meta Quest with Unity
Nishanth Chidambaram, Weichen Liu, Manas Satish Bedmutha +2