Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
Yu Zhang, Jialei Zhou, Xinchen Li +6
Current text-to-image diffusion generation typically employs complete-text conditioning. Due to the intricate syntax, diffusion transformers (DiTs) inherently suffer from a compreh…
cs.CV2024
Wills Aligner: Multi-Subject Collaborative Brain Visual Decoding
Guangyin Bao, Qi Zhang, Zixuan Gong +6
Decoding visual information from human brain activity has seen remarkable advancements in recent research. However, the diversity in cortical parcellation and fMRI patterns across…