papers

Publications (14)

cs.CV2023

Making Vision Transformers Efficient from A Token Sparsification View

Shuning Chang, Pichao Wang, Ming Lin +4

cs.CV2021

Augmented Transformer with Adaptive Graph for Temporal Action Proposal Generation

Shuning Chang, Pichao Wang, Fan Wang +2

cs.CV2026

BIFE: Better Interaction, Fewer Errors for Minute-Long Video Generation

Zeyu Zhang, Jinyuan Mao, Shuning Chang +5

cs.CV2026

Lumos-1: On Autoregressive Video Generation with Discrete Diffusion from a Unified Model Perspective

Hangjie Yuan, Weihua Chen, Jun Cen +11

cs.CV2023

Revisiting Vision Transformer from the View of Path Ensemble

Shuning Chang, Pichao Wang, Hao Luo +2

cs.CV2023

DOAD: Decoupled One Stage Action Detection Network

Shuning Chang, Pichao Wang, Fan Wang +2

cs.CV2022

KVT: k-NN Attention for Boosting Vision Transformers

Pichao Wang, Xue Wang, Fan Wang +4

cs.CV2020

Towards Accurate Human Pose Estimation in Videos of Crowded Scenes

Li Yuan, Shuning Chang, Xuecheng Nie +5

cs.CV2020

A Simple Baseline for Pose Tracking in Videos of Crowded Scenes

Li Yuan, Shuning Chang, Ziyuan Huang +6

cs.CV2023

Mix-of-Show: Decentralized Low-Rank Adaptation for Multi-Concept Customization of Diffusion Models

Yuchao Gu, Xintao Wang, Jay Zhangjie Wu +10

cs.CV2025

SparseDiT: Token Sparsification for Efficient Diffusion Transformer

Shuning Chang, Pichao Wang, Jiasheng Tang +2

cs.LG2025

Flow Along the K-Amplitude for Generative Modeling

Weitao Du, Shuning Chang, Jiasheng Tang +3

cs.CV2020

Toward Accurate Person-level Action Recognition in Videos of Crowded Scenes

Li Yuan, Yichen Zhou, Shuning Chang +6

cs.CV2026

Towards Error-Free Long Video Generation

Shuning Chang, Weihua Chen, Jiasheng Tang +8