Publications (62)
ARES: Adaptive Reasoning-Effort Steering for PPA- and Cost-Aware RTL Optimization with LLM Agents
Stef Cuyckens, Mihaela Jivanescu, Jun Yin +2
The paper presents ARES, a framework that adaptively controls the reasoning effort of large language model agents when optimizing RTL designs for power, performance, and area, whil…
PillarFlow: End-to-end Birds-eye-view Flow Estimation for Autonomous Driving
Kuan-Hui Lee, Matthew Kliemann, Adrien Gaidon +4
SparseCol: A 1320 BTOPS/W Precision-scalable NPU Exploiting Training-free Structured Bit-level Sparsity and Dynamic Dataflow
Man Shi, Vikram Jain, Weijie Jiang +4
PDPU: An Open-Source Posit Dot-Product Unit for Deep Learning Applications
Qiong Li, Chao Fang, Zhongfeng Wang
BEBERT: Efficient and Robust Binary Ensemble BERT
Jiayi Tian, Chao Fang, Haonan Wang +1
SnipSnap: A Joint Compression Format and Dataflow Co-Optimization Framework for Efficient Sparse LLM Accelerator Design
Junyi Wu, Chao Fang, Zhongfeng Wang
BETA: Binarized Energy-Efficient Transformer Accelerator at the Edge
Yuhao Ji, Chao Fang, Zhongfeng Wang
CD-PIM: A High-Bandwidth and Compute-Efficient LPDDR5-Based PIM for Low-Batch LLM Acceleration on Edge-Device
Ye Lin, Chao Fang, Xiaoyong Song +4
Global quantum discord in infinite quantum spin chains
Zhao-Yu Sun, Yan-E Liao, Bin Guo +10
The First Hardware Demonstration of a Universal Programmable RRAM-based Probabilistic Computer for Molecular Docking
Yihan He, Ming-Chun Hong, Qiming Ding +6
Determination of Multi-mode Motional Quantum States in a Trapped Ion System
Zhubing Jia, Ye Wang, Bichen Zhang +4
MUFold-SS: Protein Secondary Structure Prediction Using Deep Inception-Inside-Inception Networks
Chao Fang, Yi Shang, Dong Xu
Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning
Stef Cuyckens, Xiaoling Yi, Nitish Satya Murthy +2
HiKV: Hierarchical Importance-Aware KV Cache with Hardware Acceleration for LLM Decoding
Chao Fang, Jun Yin, Man Shi +1
Caching-at-STARS: the Next Generation Edge Caching
Zhaoming Hu, Ruikang Zhong, Chao Fang +1
High stability cryogenic system for quantum computing with compact packaged ion traps
Robert F. Spivey, Ismail V. Inlek, Zhubing Jia +9
iEEG Seizure Detection with a Sparse Hyperdimensional Computing Accelerator
Stef Cuyckens, Ryan Antonio, Chao Fang +1
Enable Lightweight and Precision-Scalable Posit/IEEE-754 Arithmetic in RISC-V Cores for Transprecision Computing
Qiong Li, Chao Fang, Longwei Huang +2
Jamming Detection and Channel Estimation for Spatially Correlated Beamspace Massive MIMO
Pengguang Du, Cheng Zhang, Yindi Jing +3
A Scalable RISC-V Vector Processor Enabling Efficient Multi-Precision DNN Inference
Chuanning Wang, Chao Fang, Xiao Wu +2
The generalization of charged AdS black hole specific volume and number density
Ziliang Wang, Miao He, Chao Fang +2
Crosstalk Suppression in Individually Addressed Two-Qubit Gates in a Trapped-Ion Quantum Computer
Chao Fang, Ye Wang, Shilin Huang +2
Co-Designing Binarized Transformer and Hardware Accelerator for Efficient End-to-End Edge Deployment
Yuhao Ji, Chao Fang, Shaobo Ma +2
borealis - A generalized global update algorithm for Boolean optimization problems
Zheng Zhu, Chao Fang, Helmut G. Katzgraber
Efficient N:M Sparse DNN Training Using Algorithm, Architecture, and Dataflow Co-Design
Chao Fang, Wei Sun, Aojun Zhou +1
An Algorithm-Hardware Co-Optimized Framework for Accelerating N:M Sparse Transformers
Chao Fang, Aojun Zhou, Zhongfeng Wang
MUFold-BetaTurn: A Deep Dense Inception Network for Protein Beta-Turn Prediction
Chao Fang, Yi Shang, Dong Xu
Precision-Scalable Microscaling Datapaths with Optimized Reduction Tree for Efficient NPU Integration
Stef Cuyckens, Xiaoling Yi, Robin Geens +4
Realization of Scalable Cirac-Zoller Multi-Qubit Gates
Chao Fang, Ye Wang, Ke Sun +1
A Precision-Scalable RISC-V DNN Processor with On-Device Learning Capability at the Extreme Edge
Longwei Huang, Chao Fang, Qiong Li +2
Batch Optimization of Frequency-Modulated Pulses for Robust Two-qubit Gates in Ion Chains
Mingyu Kang, Qiyao Liang, Bichen Zhang +5
Real-Time Panoptic Segmentation from Dense Detections
Rui Hou, Jie Li, Arjun Bhargava +5
Hybrid Precoding in Cooperative Millimeter Wave Networks
Chao Fang, Behrooz Makki, Jingya Li +1
Simulating conical intersections with trapped ions
Jacob Whitlow, Zhubing Jia, Ye Wang +3
A Scheduling Framework for Efficient MoE Inference on Edge GPU-NDP Systems
Qi Wu, Chao Fang, Jiayuan Chen +5
Thermodynamics of the Bardeen Black Hole in Anti-de Sitter Space
Cong Li, Chao Fang, Miao He +3
Discussion of a possible corrected black hole entropy
Miao He, Zi-Liang Wang, Chao Fang +2
The trouble with asymptotically safe inflation
Chao Fang, Qing-Guo Huang
Joint Scheduling and Throughput Maximization in Self-backhauled Millimeter Wave Cellular Networks
Chao Fang, Charitha Madapatha, Behrooz Makki +1
CoDec: Prefix-Shared Decoding Kernel for LLMs
Zhibin Wang, Rui Ning, Chao Fang +12
Designing Filter Functions of Frequency-Modulated Pulses for High-Fidelity Two-Qubit Gates in Ion Chains
Mingyu Kang, Ye Wang, Chao Fang +4
Ground-State Probabilistic Logic with the Simplest Binary Energy Landscape for Probabilistic Computing
Yihan He, Sheng Luo, Chao Fang +1
P3-LLM: An Integrated NPU-PIM Accelerator for Edge LLM Inference Using Hybrid Numerical Formats
Yuzong Chen, Chao Fang, Xilai Dai +4
Training Deep Neural Networks Using Posit Number System
Jinming Lu, Siyuan Lu, Zhisheng Wang +4
APT-LLM: Exploiting Arbitrary-Precision Tensor Core Computing for LLM Acceleration
Shaobo Ma, Chao Fang, Haikuo Shao +1
Modular Software for Real-Time Quantum Control Systems
Leon Riesebos, Brad Bondurant, Jacob Whitlow +9
NAE-SAT-based probabilistic membership filters
Chao Fang, Zheng Zhu, Helmut G. Katzgraber
Improving Protein Gamma-Turn Prediction Using Inception Capsule Networks
Chao Fang, Yi Shang, Dong Xu
High-fidelity Two-qubit Gates Using a MEMS-based Beam Steering System for Individual Qubit Addressing
Ye Wang, Stephen Crain, Chao Fang +6
A Novel P-bit-based Probabilistic Computing Approach for Solving the 3-D Protein Folding Problem
Chao Fang, Yihan He, Xiao Gong +1
NVAutoNet: Fast and Accurate 360 3D Visual Perception For Self Driving
Trung Pham, Mehran Maghoumi, Wanli Jiang +9
SPEED: A Scalable RISC-V Vector Processor Enabling Efficient Multi-Precision DNN Inference
Chuanning Wang, Chao Fang, Xiao Wu +2
Machine learning in physics: The pitfalls of poisoned training sets
Chao Fang, Amin Barzegar, Helmut G. Katzgraber
Group Distributionally Robust Reinforcement Learning with Hierarchical Latent Variables
Mengdi Xu, Peide Huang, Yaru Niu +8
A Game-Theoretic Framework for AI Governance
Na Zhang, Kun Yue, Chao Fang
Anda: Unlocking Efficient LLM Inference with a Variable-Length Grouped Activation Data Format
Chao Fang, Man Shi, Robin Geens +3
Efficient Arbitrary Precision Acceleration for Large Language Models on GPU Tensor Cores
Shaobo Ma, Chao Fang, Haikuo Shao +1
Hidden Inverses: Coherent Error Cancellation at the Circuit Level
Bichen Zhang, Swarnadeep Majumder, Pak Hong Leung +6
Drying of porous media by concurrent drainage and evaporation: A pore network modeling study
Haiyi Wu, Chao Fang, Rui Wu +1
On Integrated Access and Backhaul Networks: Current Status and Potentials
Charitha Madapatha, Behrooz Makki, Chao Fang +4
Quantum Simulation of Polarized Light-induced Electron Transfer with A Trapped-ion Qutrit System
Ke Sun, Chao Fang, Mingyu Kang +5
Content-Centric and Software-Defined Networking with Big Data
Haipeng Yao, Chao Qiu, Chao Fang +2