1 paper
Benjamin Aubin, Gonzalo Iñaki Quintana, Onur Tasar +4
Training large text-to-image models requires high-quality, curated datasets with diverse content and detailed captions. Yet the cost and complexity of collecting, filtering, dedupl…