2 papers
cs.CV2024
Imagen 3
Imagen-Team-Google, :, Jason Baldridge +257
We introduce Imagen 3, a latent diffusion model that generates high quality images from text prompts. We describe our quality and responsibility evaluations. Imagen 3 is preferred…
cs.LG2024
AmCLR: Unified Augmented Learning for Cross-Modal Representations
Ajay Jagannath, Aayush Upadhyay, Anant Mehta
Contrastive learning has emerged as a pivotal framework for representation learning, underpinning advances in both unimodal and bimodal applications like SimCLR and CLIP. To addres…