Publications (203)
Convergence Rate Analysis of the AdamW-style Shampoo: Unifying One-Sided and Two-Sided Preconditioning
Huan Li, Yiming Dong, Zhouchen Lin
Optimization-Induced Graph Implicit Nonlinear Diffusion
Qi Chen, Yifei Wang, Yisen Wang +2
Patch-level Neighborhood Interpolation: A General and Effective Graph-based Regularization Strategy
Ke Sun, Bing Yu, Zhouchen Lin +1
Fixed-Rank Representation for Unsupervised Visual Learning
Risheng Liu, Zhouchen Lin, Fernando De la Torre +1
Inducing Neural Collapse in Imbalanced Learning: Do We Really Need a Learnable Classifier at the End of Deep Neural Network?
Yibo Yang, Shixiang Chen, Xiangtai Li +3
Completing Low-Rank Matrices with Corrupted Samples from Few Coefficients in General Basis
Hongyang Zhang, Zhouchen Lin, Chao Zhang
Rethinking the Flow-Based Gradual Domain Adaptation: A Semi-Dual Optimal Transport Perspective
Zhichao Chen, Zhan Zhuang, Yunfei Teng +6
LiteToken: Removing Intermediate Merge Residues From BPE Tokenizers
Yike Sun, Haotong Yang, Zhouchen Lin +1
Training Feedback Spiking Neural Networks by Implicit Differentiation on the Equilibrium State
Mingqing Xiao, Qingyan Meng, Zongpeng Zhang +2
SpecGradFilter: A Spectral Gradient Filtering Framework for Taming Federated Heterogeneity
Liyang Yuan, Yibo Yang, Dandan Guo +2
DistDF: Time-Series Forecasting Needs Joint-Distribution Wasserstein Alignment
Hao Wang, Licheng Pan, Yuan Lu +7
LION: Implicit Vision Prompt Tuning
Haixin Wang, Jianlong Chang, Xiao Luo +3
On Leveraging Unlabeled Data for Concurrent Positive-Unlabeled Classification and Robust Generation
Bing Yu, Ke Sun, He Wang +2
Towards Improving the Consistency, Efficiency, and Flexibility of Differentiable Neural Architecture Search
Yibo Yang, Shan You, Hongyang Li +3
Pyramidal Flow Matching for Efficient Video Generative Modeling
Yang Jin, Zhicheng Sun, Ningyuan Li +7
Robust Recovery of Subspace Structures by Low-Rank Representation
Guangcan Liu, Zhouchen Lin, Shuicheng Yan +3
SPIDER: Near-Optimal Non-Convex Optimization via Stochastic Path Integrated Differential Estimator
Cong Fang, Chris Junchi Li, Zhouchen Lin +1
Adaptive Global and Fine-Grained Perceptual Fusion for MLLM Embeddings Compatible with Hard Negative Amplification
Lexiang Hu, Youze Xue, Dian Li +2
Task-Robust Pre-Training for Worst-Case Downstream Adaptation
Jianghui Wang, Yang Chen, Xingyu Xie +2
Histogram Transform Ensembles for Large-scale Regression
Hanyuan Hang, Zhouchen Lin, Xiaoyu Liu +1
Robust Estimation of 3D Human Poses from a Single Image
Chunyu Wang, Yizhou Wang, Zhouchen Lin +2
Rethinking Facial Expression Recognition in the Era of Multimodal Large Language Models: Benchmark, Datasets, and Beyond
Fan Zhang, Haoxuan Li, Shengju Qian +9
Investigating Bi-Level Optimization for Learning and Vision from a Unified Perspective: A Survey and Beyond
Risheng Liu, Jiaxin Gao, Jin Zhang +2
GBHT: Gradient Boosting Histogram Transform for Density Estimation
Jingyi Cui, Hanyuan Hang, Yisen Wang +1
Enhancing the Robustness of Deep Neural Networks by Boundary Conditional GAN
Ke Sun, Zhanxing Zhu, Zhouchen Lin
On the Lower Bound of Minimizing Polyak-Åojasiewicz Functions
Pengyun Yue, Cong Fang, Zhouchen Lin
Adan: Adaptive Nesterov Momentum Algorithm for Faster Optimizing Deep Models
Xingyu Xie, Pan Zhou, Huan Li +2
Subspace Clustering Based Tag Sharing for Inductive Tag Matrix Refinement with Complex Errors
Yuqing Hou, Zhouchen Lin, Jin-ge Yao
Empowering LLMs with Logical Reasoning: A Comprehensive Survey
Fengxiang Cheng, Haoxuan Li, Fenrong Liu +3
Restarted Nonconvex Accelerated Gradient Descent: No More Polylogarithmic Factor in the $O(ε^{-7/4})$ Complexity
Huan Li, Zhouchen Lin
Chaos is a Ladder: A New Theoretical Understanding of Contrastive Learning via Augmentation Overlap
Yifei Wang, Qi Zhang, Yisen Wang +2
Nonconvex Nonsmooth Low-Rank Minimization via Iteratively Reweighted Nuclear Norm
Canyi Lu, Jinhui Tang, Shuicheng Yan +1
Is Attention Better Than Matrix Decomposition?
Zhengyang Geng, Meng-Hao Guo, Hongxu Chen +3
PDO-eConvs: Partial Differential Operator Based Equivariant Convolutions
Zhengyang Shen, Lingshen He, Zhouchen Lin +1
Maximum-and-Concatenation Networks
Xingyu Xie, Hao Kong, Jianlong Wu +3
A Block Lanczos with Warm Start Technique for Accelerating Nuclear Norm Minimization Algorithms
Zhouchen Lin, Siming Wei
Generalist++: A Meta-learning Framework for Mitigating Trade-off in Adversarial Training
Yisen Wang, Yichuan Mo, Hongjun Wang +2
Reparameterized Sampling for Generative Adversarial Networks
Yifei Wang, Yisen Wang, Jiansheng Yang +1
Revisiting EXTRA for Smooth Distributed Optimization
Huan Li, Zhouchen Lin
Beyond representational alignment with brain-guided language models for robust reasoning
Mingqing Xiao, Kai Du, Zhouchen Lin
Recurrent Squeeze-and-Excitation Context Aggregation Net for Single Image Deraining
Xia Li, Jianlong Wu, Zhouchen Lin +2
Tensor Robust Principal Component Analysis: Exact Recovery of Corrupted Low-Rank Tensors via Convex Optimization
Canyi Lu, Jiashi Feng, Yudong Chen +3
Quadratic Direct Forecast for Training Multi-Step Time-Series Forecast Models
Hao Wang, Licheng Pan, Yuan Lu +7
Stepsize anything: A unified learning rate schedule for budgeted-iteration training
Anda Tang, Yiming Dong, Yutao Zeng +2
Correlation Adaptive Subspace Segmentation by Trace Lasso
Canyi Lu, Jiashi Feng, Zhouchen Lin +1
Beyond Rational Illusion: Behaviorally Realistic Strategic Classification
Xinpeng Lv, Yunxin Mao, Renzhe Xu +11
On the $O(\frac{\sqrt{d}}{T^{1/4}})$ Convergence Rate of RMSProp and Its Momentum Extension Measured by $\ell_1$ Norm
Huan Li, Yiming Dong, Zhouchen Lin
Towards Efficient Scene Understanding via Squeeze Reasoning
Xiangtai Li, Xia Li, Ansheng You +5
Essential Tensor Learning for Multi-view Spectral Clustering
Jianlong Wu, Zhouchen Lin, Hongbin Zha
Faster and Non-ergodic O(1/K) Stochastic Alternating Direction Method of Multipliers
Cong Fang, Feng Cheng, Zhouchen Lin
On Training Implicit Models
Zhengyang Geng, Xin-Yu Zhang, Shaojie Bai +2
Convergence Rate Analysis of SOAP with Arbitrary Orthogonal Projection Matrices
Huan Li, Zhouchen Lin
Towards Understanding Adversarial Examples Systematically: Exploring Data Size, Task and Model Factors
Ke Sun, Zhanxing Zhu, Zhouchen Lin
Image Tag Completion and Refinement by Subspace Clustering and Matrix Completion
Yuqing Hou, Zhouchen Lin
Proximal Iteratively Reweighted Algorithm with Multiple Splitting for Nonconvex Sparsity Optimization
Canyi Lu, Yunchao Wei, Zhouchen Lin +1
GL-Fusion: Rethinking the Combination of Graph Neural Network and Large Language model
Haotong Yang, Xiyuan Wang, Qian Tao +3
FedAdamW: A Communication-Efficient Optimizer with Convergence and Generalization Guarantees for Federated Large Models
Junkang Liu, Fanhua Shang, Hongying Liu +5
DNT: a Deeply Normalized Transformer that can be trained by Momentum SGD
Xianbiao Qi, Marco Chen, Wenjie Xiao +4
Linearized Alternating Direction Method with Adaptive Penalty and Warm Starts for Fast Solving Transform Invariant Low-Rank Textures
Xiang Ren, Zhouchen Lin
Rethinking Knowledge Graph Evaluation Under the Open-World Assumption
Haotong Yang, Zhouchen Lin, Muhan Zhang
Some Software Packages for Partial SVD Computation
Zhouchen Lin
PanopticPartFormer++: A Unified and Decoupled View for Panoptic Part Segmentation
Xiangtai Li, Shilin Xu, Yibo Yang +6
Gradient Boosted Binary Histogram Ensemble for Large-scale Regression
Hanyuan Hang, Tao Huang, Yuchao Cai +2
Temporal Spiking Neural Networks with Synaptic Delay for Graph Reasoning
Mingqing Xiao, Yixin Zhu, Di He +1
Nonconvex Sparse Spectral Clustering by Alternating Direction Method of Multipliers and Its Convergence Analysis
Canyi Lu, Jiashi Feng, Zhouchen Lin +1
DIGIC: Domain Generalizable Imitation Learning by Causal Discovery
Yang Chen, Yitao Liang, Zhouchen Lin
OmniTabBench: Mapping the Empirical Frontiers of GBDTs, Neural Networks, and Foundation Models for Tabular Data at Scale
Dihong Jiang, Ruoqi Cao, Zhiyuan Dang +8
PointFlow: Flowing Semantics Through Points for Aerial Image Segmentation
Xiangtai Li, Hao He, Xia Li +6
Graph Contrastive Clustering
Huasong Zhong, Jianlong Wu, Chong Chen +5
Dissecting the Diffusion Process in Linear Graph Convolutional Networks
Yifei Wang, Yisen Wang, Jiansheng Yang +1
Accelerated Alternating Direction Method of Multipliers: an Optimal $O(1/K)$ Nonergodic Analysis
Huan Li, Zhouchen Lin
Beyond likelihood ratio bias: Nested multi-time-scale stochastic approximation for likelihood-free parameter estimation
Zehao Li, Zhouchen Lin, Yijie Peng
VACT: A Video Automatic Causal Testing System and a Benchmark
Haotong Yang, Qingyuan Zheng, Yunjian Gao +4
Under-bagging Nearest Neighbors for Imbalanced Classification
Hanyuan Hang, Yuchao Cai, Hanfang Yang +1
Toward Designing Intelligent PDEs for Computer Vision: An Optimal Control Approach
Risheng Liu, Zhouchen Lin, Wei Zhang +2
On the Complexity Analysis of the Primal Solutions for the Accelerated Randomized Dual Coordinate Ascent
Huan Li, Zhouchen Lin
When Tabular Foundation Models Meet Strategic Tabular Data: A Prior Alignment Approach
Xinpeng Lv, Yunxin Mao, Renzhe Xu +13
Low-Dimension-to-High-Dimension Generalization And Its Implications for Length Generalization
Yang Chen, Long Yang, Yitao Liang +1
Convergence Rates Analysis of The Quadratic Penalty Method and Its Applications to Decentralized Distributed Optimization
Huan Li, Cong Fang, Zhouchen Lin
Provable Accelerated Gradient Method for Nonconvex Low Rank Optimization
Huan Li, Zhouchen Lin
MME-VideoOCR: Evaluating OCR-Based Capabilities of Multimodal LLMs in Video Scenarios
Yang Shi, Huanqian Wang, Wulin Xie +20
BoundarySqueeze: Image Segmentation as Boundary Squeezing
Hao He, Xiangtai Li, Yibo Yang +5
Convergence Rate Analysis of LION
Yiming Dong, Huan Li, Zhouchen Lin
On the Adversarial Transferability of Generalized "Skip Connections"
Yisen Wang, Yichuan Mo, Dongxian Wu +3
Dynamical System Inspired Adaptive Time Stepping Controller for Residual Network Families
Yibo Yang, Jianlong Wu, Hongyang Li +3
Generalized Singular Value Thresholding
Canyi Lu, Changbo Zhu, Chunyan Xu +2
MorphoBench: A Benchmark with Difficulty Adaptive to Model Reasoning
Xukai Wang, Xuanbo Liu, Mingrui Chen +16
Constructing a Non-Negative Low Rank and Sparse Graph with Data-Adaptive Features
Liansheng Zhuang, Shenghua Gao, Jinhui Tang +3
Towards Theoretically Inspired Neural Initialization Optimization
Yibo Yang, Hong Wang, Haobo Yuan +1
Two-Dimensional Weisfeiler-Lehman Graph Neural Networks for Link Prediction
Yang Hu, Xiyuan Wang, Zhouchen Lin +2
Online Pseudo-Zeroth-Order Training of Neuromorphic Spiking Neural Networks
Mingqing Xiao, Qingyan Meng, Zongpeng Zhang +2
The Augmented Lagrange Multiplier Method for Exact Recovery of Corrupted Low-Rank Matrices
Zhouchen Lin, Minming Chen, Yi Ma
Code Prompting: a Neural Symbolic Method for Complex Reasoning in Large Language Models
Yi Hu, Haotong Yang, Zhouchen Lin +1
Balance, Imbalance, and Rebalance: Understanding Robust Overfitting from a Minimax Game Perspective
Yifei Wang, Liangchen Li, Jiansheng Yang +2
Symmetry Discovery for Different Data Types
Lexiang Hu, Yikang Li, Zhouchen Lin
Improving Semantic Segmentation via Decoupled Body and Edge Supervision
Xiangtai Li, Xia Li, Li Zhang +5
Global Convergence of Over-parameterized Deep Equilibrium Models
Zenan Ling, Xingyu Xie, Qiuhao Wang +2
SPIDE: A Purely Spike-based Method for Training Feedback Spiking Neural Networks
Mingqing Xiao, Qingyan Meng, Zongpeng Zhang +2
SOGNet: Scene Overlap Graph Network for Panoptic Segmentation
Yibo Yang, Hongyang Li, Xia Li +3
Globally Variance-Constrained Sparse Representation and Its Application in Image Set Coding
Xiang Zhang, Jiarui Sun, Siwei Ma +4