Publications (138)
The Art of Efficient Reasoning: Data, Reward, and Optimization
Taiqiang Wu, Zenan Xu, Bo Zhou +1
Rethinking Kullback-Leibler Divergence in Knowledge Distillation for Large Language Models
Taiqiang Wu, Chaofan Tao, Jiahao Wang +3
Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning
Zhen Li, Yupeng Su, Runming Yang +5
A Survey on the Honesty of Large Language Models
Siheng Li, Cheng Yang, Taiqiang Wu +12
Distribution-Aware Hadamard Quantization for Hardware-Efficient Implicit Neural Representations
Wenyong Zhou, Jiachen Ren, Taiqiang Wu +3
Enhancing Robustness of Implicit Neural Representations Against Weight Perturbations
Wenyong Zhou, Yuxin Cheng, Zhengwu Liu +3
Prefilling-dLLM: Predictive Prefilling for Long-Context Inference in Diffusion Language Models
Jing Xiong, Qi Han, Shansan Gong +5
NANQ: Noise-Floor-Aware Mixed-Precision Non-Uniform Quantization for Analog Compute-in-Memory
Yizhe Chen, Wenshuai Yao, Saiya Wang +6
QuadINR: Hardware-Efficient Implicit Neural Representations Through Quadratic Activation
Wenyong Zhou, Boyu Li, Jiachen Ren +4
Model Evolution Under Zeroth-Order Optimization: A Neural Tangent Kernel Perspective
Chen Zhang, Yuxin Cheng, Chenchen Ding +5
A Tensor Network Kalman filter with an application in recursive MIMO Volterra system identification
Kim Batselier, Zhongming Chen, Ngai Wong
Gradually Excavating External Knowledge for Implicit Complex Question Answering
Chang Liu, Xiaoguang Li, Lifeng Shang +4
Mixture-of-Subspaces in Low-Rank Adaptation
Taiqiang Wu, Jiahao Wang, Zhe Zhao +1
CTR-Sink: Attention Sink for Language Models in Click-Through Rate Prediction
Zixuan Li, Binzong Geng, Jing Xiong +11
Attention Sink in Transformers: A Survey on Utilization, Interpretation, and Mitigation
Zunhai Su, Hengyuan Zhang, Wei Wu +24
A Spectral Perspective towards Understanding and Improving Adversarial Robustness
Binxiao Huang, Rui Lin, Chaofan Tao +1
Fast and Accurate Tensor Completion with Total Variation Regularized Tensor Trains
Ching-Yun Ko, Kim Batselier, Wenjian Yu +1
A QR Algorithm for Symmetric Tensors
Kim Batselier, Ngai Wong
UNComp: Can Matrix Entropy Uncover Sparsity? -- A Compressor Design from an Uncertainty-Aware Perspective
Jing Xiong, Jianghan Shen, Fanghua Ye +9
Lite it fly: An All-Deformable-Butterfly Network
Rui Lin, Jason Chun Lok Li, Jiajun Zhou +3
MINR: Efficient Implicit Neural Representations for Multi-Image Encoding
Wenyong Zhou, Taiqiang Wu, Zhengwu Liu +3
Scaling Laws with Vocabulary: Larger Models Deserve Larger Vocabularies
Chaofan Tao, Qian Liu, Longxu Dou +5
Tensor Network alternating linear scheme for MIMO Volterra system identification
Kim Batselier, Zhongming Chen, Ngai Wong
DART: Difficulty-Adaptive Reasoning Truncation for Efficient Large Language Models
Ruofan Zhang, Bin Xia, Zhen Cheng +4
To Fold or Not to Fold: Graph Regularized Tensor Train for Visual Data Completion
Le Xu, Lei Cheng, Ngai Wong +1
Exploiting Elasticity in Tensor Ranks for Compressing Neural Networks
Jie Ran, Rui Lin, Hayden K. H. So +2
Multimodal Transformer for Automatic 3D Annotation and Object Detection
Chang Liu, Xiaoyan Qian, Binxiao Huang +4
PECAN: A Product-Quantized Content Addressable Memory Network
Jie Ran, Rui Lin, Jason Chun Lok Li +2
CktFormalizer: Autoformalization of Natural Language into Circuit Representations
Jing Xiong, Qi Han, Chenchen Ding +4
Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models
Hengyuan Zhang, Zhihao Zhang, Mingyang Wang +26
Selective KV Cache Protection for Noise-Resilient LLM Inference on Analog Compute-In-Memory Systems
Yuannuo Feng, Wenyong Zhou, Yuang Ma +5
Fighter: Unveiling the Graph Convolutional Nature of Transformers in Time Series Modeling
Chen Zhang, Weixin Bu, Wendong Xu +3
Matrix Product Operator Restricted Boltzmann Machines
Cong Chen, Kim Batselier, Ching-Yun Ko +1
Learning Spatially Collaged Fourier Bases for Implicit Neural Representation
Jason Chun Lok Li, Chang Liu, Binxiao Huang +1
Efficient Generative Modeling with Unitary Matrix Product States Using Riemannian Optimization
Haotong Duan, Zhongming Chen, Ngai Wong
Poisoning-based Backdoor Attacks for Arbitrary Target Label with Positive Triggers
Binxiao Huang, Jason Chun Lok, Chang Liu +1
Nonparametric Teaching of Implicit Neural Representations
Chen Zhang, Steven Tin Sui Luo, Jason Chun Lok Li +2
HOTCAKE: Higher Order Tucker Articulated Kernels for Deeper CNN Compression
Rui Lin, Ching-Yun Ko, Zhuolun He +5
A constructive arbitrary-degree Kronecker product decomposition of tensors
Kim Batselier, Ngai Wong
Stochastic Multivariate Universal-Radix Finite-State Machine: a Theoretically and Practically Elegant Nonlinear Function Approximator
Xincheng Feng, Guodong Shen, Jianhao Hu +2
Tensor Computation: A New Framework for High-Dimensional Problems in EDA
Zheng Zhang, Kim Batselier, Haotian Liu +2
XStreamVGGT: Extremely Memory-Efficient Streaming Vision Geometry Grounded Transformer with KV Cache Compression
Zunhai Su, Weihao Ye, Hansen Feng +5
Computing low-rank approximations of large-scale matrices with the Tensor Network randomized SVD
Kim Batselier, Wenjian Yu, Luca Daniel +1
MCUBERT: Memory-Efficient BERT Inference on Commodity Microcontrollers
Zebin Yang, Renze Chen, Taiqiang Wu +5
Context-Aware Transformer for 3D Point Cloud Automatic Annotation
Xiaoyan Qian, Chang Liu, Xiaojuan Qi +3
High-precision and low-latency widefield diamond quantum sensing with neuromorphic vision sensors
Zhiyuan Du, Madhav Gupta, Feng Xu +9
Hundred-Kilobyte Lookup Tables for Efficient Single-Image Super-Resolution
Binxiao Huang, Jason Chun Lok Li, Jie Ran +4
Find Your Optimal Teacher: Personalized Data Synthesis via Router-Guided Multi-Teacher Distillation
Hengyuan Zhang, Shiping Yang, Xiao Liang +8
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
Jiajun Zhou, Yifan Yang, Kai Zhen +6
Deep Compression of Sum-Product Networks on Tensor Networks
Ching-Yun Ko, Cong Chen, Yuke Zhang +2
Residual Decoding: Mitigating Hallucinations in Large Vision-Language Models via History-Aware Residual Guidance
Xinrong Chen, Xu Chu, Yingmin Qiu +8
Beyond Outliers: A Data-Free Layer-wise Mixed-Precision Quantization Approach Driven by Numerical and Structural Dual-Sensitivity
Hengyuan Zhang, Xinrong Chen, Zunhai Su +10
Extending Straight-Through Estimation for Robust Neural Networks on Analog CIM Hardware
Yuannuo Feng, Wenyong Zhou, Yuexi Lyu +4
AnchorTP: Resilient LLM Inference with State-Preserving Elastic Tensor Parallelism
Wendong Xu, Chujie Chen, He Xiao +8
D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation
Junlin Li, Shuangyong Song, Guodong Du +6
Multilayer Perceptron Based Stress Evolution Analysis under DC Current Stressing for Multi-segment Wires
Tianshu Hou, Peining Zhen, Ngai Wong +4
PatchINR: Patch-Based Implicit Neural Representations for Efficient and Scalable Inference
Jiachen Ren, Wenyong Zhou, Taiqiang Wu +4
S3-Net: A Fast and Lightweight Video Scene Understanding Network by Single-shot Segmentation
Yuan Cheng, Yuchao Yang, Hai-Bao Chen +2
Tensor Train Factorization and Completion under Noisy Data with Prior Analysis and Rank Estimation
Le Xu, Lei Cheng, Ngai Wong +1
Frequency Regularization for Improving Adversarial Robustness
Binxiao Huang, Chaofan Tao, Rui Lin +1
LLM-Barber: Block-Aware Rebuilder for Sparsity Mask in One-Shot for Large Language Models
Yupeng Su, Ziyi Guan, Xiaoqun Liu +6
Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning
Zhao Yang, Yuxuan Jiang, Ting-Chih Chen +18
Parallelized Tensor Train Learning of Polynomial Classifiers
Zhongming Chen, Kim Batselier, Johan A. K. Suykens +1
Coarse to Fine: Image Restoration Boosted by Multi-Scale Low-Rank Tensor Completion
Rui Lin, Cong Chen, Ngai Wong
ODG-Q: Robust Quantization via Online Domain Generalization
Chaofan Tao, Ngai Wong
BPDQ: Bit-Plane Decomposition Quantization on a Variable Grid for Large Language Models
Junyu Chen, Jungang Li, Jing Xiong +11
Quantization Meets Reasoning: Exploring and Mitigating Degradation of Low-Bit LLMs in Mathematical Reasoning
Zhen Li, Yupeng Su, Songmiao Wang +8
MMFormalizer: Multimodal Autoformalization in the Wild
Jing Xiong, Qi Han, Yunta Hsieh +11
Kernelized Support Tensor Train Machines
Cong Chen, Kim Batselier, Wenjian Yu +1
NTK-Guided Implicit Neural Teaching
Chen Zhang, Wei Zuo, Bingyang Cheng +4
Scalable Reshaping of Diamond Particles via Programmable Nanosculpting
Tongtong Zhang, Fuqiang Sun, Yaorong Wang +11
ASMR: Activation-sharing Multi-resolution Coordinate Networks For Efficient Inference
Jason Chun Lok Li, Steven Tin Sui Luo, Le Xu +1
LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language Models
Yifan Yang, Jiajun Zhou, Ngai Wong +1
Autoregressive Models in Vision: A Survey
Jing Xiong, Gongye Liu, Lun Huang +17
PhyX: Does Your Model Have the "Wits" for Physical Reasoning?
Hui Shen, Taiqiang Wu, Qi Han +16
POPQORN: Quantifying Robustness of Recurrent Neural Networks
Ching-Yun Ko, Zhaoyang Lyu, Tsui-Wei Weng +3
Taming Lookup Tables for Efficient Image Retouching
Sidi Yang, Binxiao Huang, Mingdeng Cao +4
Decomposing Densification in Gaussian Splatting for Faster 3D Scene Reconstruction
Binxiao Huang, Zhengwu Liu, Ngai Wong
Matrix output extension of the tensor network Kalman filter with an application in MIMO Volterra system identification
Kim Batselier, Ngai Wong
EZCrop: Energy-Zoned Channels for Robust Output Pruning
Rui Lin, Jie Ran, Dongpeng Wang +2
MERACLE: Constructive layer-wise conversion of a Tensor Train into a MERA
Kim Batselier, Andrzej Cichocki, Ngai Wong
What Do Adversarially trained Neural Networks Focus: A Fourier Domain-based Study
Binxiao Huang, Chaofan Tao, Rui Lin +1
ATTS: Asynchronous Test-Time Scaling via Conformal Prediction
Jing Xiong, Qiujiang Chen, Fanghua Ye +11
Binary Weight Multi-Bit Activation Quantization for Compute-in-Memory CNN Accelerators
Wenyong Zhou, Zhengwu Liu, Yuan Ren +1
A Time- and Energy-Efficient CNN with Dense Connections on Memristor-Based Chips
Wenyong Zhou, Yuan Ren, Jiajun Zhou +2
What Makes Interaction Trajectories Effective for Training Terminal Agents?
Sidi Yang, Chaofan Tao, Jierun Chen +11
MAP-Gen: An Automated 3D-Box Annotation Flow with Multimodal Attention Point Generator
Chang Liu, Xiaoyan Qian, Xiaojuan Qi +3
Overcoming Beam Squint in Dual-Wideband mmWave MIMO Channel Estimation: A Bayesian Multi-Band Sparsity Approach
Le Xu, Lei Cheng, Ngai Wong +2
ELPO: Ensemble Learning Based Prompt Optimization for Large Language Models
Qing Zhang, Bing Xu, Xudong Zhang +9
GuiLoMo: Allocating Expert Number and Rank for LoRA-MoE via Bilevel Optimization with GuidedSelection Vectors
Hengyuan Zhang, Xinrong Chen, Yingmin Qiu +7
Perspective-aware 3D Gaussian Inpainting with Multi-view Consistency
Yuxin Cheng, Binxiao Huang, Taiqiang Wu +5
FAT: Learning Low-Bitwidth Parametric Representation via Frequency-Aware Transformation
Chaofan Tao, Rui Lin, Quan Chen +3
ROMER: Expert Replacement and Router Calibration for Robust MoE LLMs on Analog Compute-in-Memory Systems
Wenyong Zhou, Yuannuo Feng, Yizhe Chen +6
DnLUT: Ultra-Efficient Color Image Denoising via Channel-Aware Lookup Tables
Sidi Yang, Binxiao Huang, Yulun Zhang +3
MiSC: Mixed Strategies Crowdsourcing
Ching-Yun Ko, Rui Lin, Shu Li +1
PTQTP: Post-Training Quantization to Trit-Planes for Large Language Models
He Xiao, Runming Yang, Qingyao Yang +6
A Constructive Algorithm for Decomposing a Tensor into a Finite Sum of Orthonormal Rank-1 Terms
Kim Batselier, Haotian Liu, Ngai Wong
Nonparametric Teaching of Attention Learners
Chen Zhang, Jianghui Wang, Bingyang Cheng +7
DoPE: Denoising Rotary Position Embedding
Jing Xiong, Liyang Fan, Hui Shen +4
Nonparametric Teaching for Graph Property Learners
Chen Zhang, Weixin Bu, Zeyi Ren +3