1 citations · 1 across the 3 of their papers we have counts for
4 papers
IMG: Calibrating Diffusion Models via Implicit Multimodal Guidance
Jiayi Guo, Chuanhao Yan, Xingqian Xu +4
Ensuring precise multimodal alignment between diffusion-generated images and input prompts has been a long-standing challenge. Earlier works finetune diffusion weight using high-qu…
RAGME: Retrieval Augmented Video Generation for Enhanced Motion Realism
Elia Peruzzo, Dejia Xu, Xingqian Xu +2
Video generation is experiencing rapid growth, driven by advances in diffusion models and the development of better and larger datasets. However, producing high-quality videos rema…
Safe Vision-Language Models via Unsafe Weights Manipulation
Moreno D'Incà, Elia Peruzzo, Xingqian Xu +3
Vision-language models (VLMs) often inherit the biases and unsafe associations present within their large-scale training dataset. While recent approaches mitigate unsafe behaviors,…
GradBias: Unveiling Word Influence on Bias in Text-to-Image Generative Models
Moreno D'Incà, Elia Peruzzo, Massimiliano Mancini +3
Recent progress in Text-to-Image (T2I) generative models has enabled high-quality image generation. As performance and accessibility increase, these models are gaining significant…