2 papers
cs.CV2025
Color encoding in Latent Space of Stable Diffusion Models
Guillem Arias, Ariadna SolÃ, Martà Armengod +1
Recent advances in diffusion-based generative models have achieved remarkable visual fidelity, yet a detailed understanding of how specific perceptual attributes - such as color an…
cs.CV2025
Color in Visual-Language Models: CLIP deficiencies
Guillem Arias, Ramon Baldrich, Maria Vanrell
This work explores how color is encoded in CLIP (Contrastive Language-Image Pre-training) which is currently the most influential VML (Visual Language model) in Artificial Intellig…