3 papers
cs.CV2025
Diverse Video Generation with Determinantal Point Process-Guided Policy Optimization
Tahira Kazimi, Connor Dunlop, Pinar Yanardag
While recent text-to-video (T2V) diffusion models have achieved impressive quality and prompt alignment, they often produce low-diversity outputs when sampling multiple videos from…
cs.CV2025
Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models
Kiymet Akdemir, Tahira Kazimi, Pinar Yanardag
Story visualization has become a popular task where visual scenes are generated to depict a narrative across multiple panels. A central challenge in this setting is maintaining vis…
cs.CV2024
Explaining in Diffusion: Explaining a Classifier Through Hierarchical Semantics with Text-to-Image Diffusion Models
Tahira Kazimi, Ritika Allada, Pinar Yanardag
Classifiers are important components in many computer vision tasks, serving as the foundational backbone of a wide variety of models employed across diverse applications. However,…