3 papers
cs.CV2026
UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention
Yuyao Zhang, Yu-Wing Tai
Ultra-high-resolution text-to-image generation is increasingly vital for applications requiring fine-grained textures and global structural fidelity, yet state-of-the-art text-to-i…
cs.CV2025
ContextAnyone: Context-Aware Diffusion for Character-Consistent Text-to-Video Generation
Ziyang Mai, Yu-Wing Tai
Text-to-video (T2V) generation has advanced rapidly, yet maintaining consistent character identities across scenes remains a major challenge. Existing personalization methods often…
cs.CV2025
PS-ReID: Advancing Person Re-Identification and Precise Segmentation with Multimodal Retrieval
Jincheng Yan, Yun Wang, Xiaoyan Luo +1
Person re-identification (ReID) plays a critical role in applications such as security surveillance and criminal investigations. Most traditional image-based ReID methods face chal…