1 citations · 1 across the 2 of their papers we have counts for
4 papers · 1 filter
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
Yu Zhang, Jialei Zhou, Xinchen Li +6
Current text-to-image diffusion generation typically employs complete-text conditioning. Due to the intricate syntax, diffusion transformers (DiTs) inherently suffer from a compreh…
Wills Aligner: Multi-Subject Collaborative Brain Visual Decoding
Guangyin Bao, Qi Zhang, Zixuan Gong +6
Decoding visual information from human brain activity has seen remarkable advancements in recent research. However, the diversity in cortical parcellation and fMRI patterns across…
An EM Framework for Online Incremental Learning of Semantic Segmentation
Shipeng Yan, Jiale Zhou, Jiangwei Xie +2
Incremental learning of semantic segmentation has emerged as a promising strategy for visual scene interpretation in the open- world setting. However, it remains challenging to acq…
Learning Implicit Temporal Alignment for Few-shot Video Classification
Songyang Zhang, Jiale Zhou, Xuming He
Few-shot video classification aims to learn new video categories with only a few labeled examples, alleviating the burden of costly annotation in real-world applications. However,…