papers
Publications (14)
cs.CV2023
Making Vision Transformers Efficient from A Token Sparsification View
Shuning Chang, Pichao Wang, Ming Lin +4
cs.CV2021
Augmented Transformer with Adaptive Graph for Temporal Action Proposal Generation
Shuning Chang, Pichao Wang, Fan Wang +2
cs.CV2026
BIFE: Better Interaction, Fewer Errors for Minute-Long Video Generation
Zeyu Zhang, Jinyuan Mao, Shuning Chang +5
cs.CV2026
Lumos-1: On Autoregressive Video Generation with Discrete Diffusion from a Unified Model Perspective
Hangjie Yuan, Weihua Chen, Jun Cen +11
cs.CV2023
Revisiting Vision Transformer from the View of Path Ensemble
Shuning Chang, Pichao Wang, Hao Luo +2
cs.CV2023
DOAD: Decoupled One Stage Action Detection Network
Shuning Chang, Pichao Wang, Fan Wang +2
cs.CV2022
KVT: k-NN Attention for Boosting Vision Transformers
Pichao Wang, Xue Wang, Fan Wang +4
cs.CV2020
Towards Accurate Human Pose Estimation in Videos of Crowded Scenes
Li Yuan, Shuning Chang, Xuecheng Nie +5
cs.CV2020
A Simple Baseline for Pose Tracking in Videos of Crowded Scenes
Li Yuan, Shuning Chang, Ziyuan Huang +6
cs.CV2023
Mix-of-Show: Decentralized Low-Rank Adaptation for Multi-Concept Customization of Diffusion Models
Yuchao Gu, Xintao Wang, Jay Zhangjie Wu +10
cs.CV2025
SparseDiT: Token Sparsification for Efficient Diffusion Transformer
Shuning Chang, Pichao Wang, Jiasheng Tang +2
cs.LG2025
Flow Along the K-Amplitude for Generative Modeling
Weitao Du, Shuning Chang, Jiasheng Tang +3
cs.CV2020
Toward Accurate Person-level Action Recognition in Videos of Crowded Scenes
Li Yuan, Yichen Zhou, Shuning Chang +6
cs.CV2026
Towards Error-Free Long Video Generation
Shuning Chang, Weihua Chen, Jiasheng Tang +8