4 papers
SI-Edit: Toward Sketch-Instruction Guided Local Image Editing with Pixel-Level Precision
Weixin Ye, Wei Wang, Hongguang Zhu +1
Despite rapid advances in generative models, achieving pixel-level precision in sketch-based image editing remains a persistent challenge, particularly for fine-grained local defor…
All-in-One Slider for Attribute Manipulation in Diffusion Models
Weixin Ye, Hongguang Zhu, Wei Wang +3
Text-to-image (T2I) diffusion models have made significant strides in generating high-quality images. However, progressively manipulating certain attributes of generated images to…
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
Weixin Ye, Wei Wang, Yahui Liu +5
In federated learning, Transformer, as a popular architecture, faces critical challenges in defending against gradient attacks and improving model performance in both Computer Visi…
Guiding the Experts: Semantic Priors for Efficient and Focused MoE Routing
Chengxi Min, Wei Wang, Yahui Liu +4
Mixture-of-Experts (MoE) models have emerged as a promising direction for scaling vision architectures efficiently. Among them, Soft MoE improves training stability by assigning ea…