Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
When Cultures Move: Measuring and Improving Multicultural Text-to-Video Generation
Shuowei Li, Yuming Zhao, Parth Bhalerao +1
Text-to-video (T2V) generation has rapidly progressed in visual fidelity, yet its ability to faithfully represent multiple cultures within a single prompt remains underexplored. We…
cs.CV2026
When Cultures Meet: Multicultural Text-to-Image Generation
Parth Bhalerao, Mounika Yalamarty, Brian Trinh +1
Text-to-image generation models have achieved strong performance in culturally homogeneous settings, yet their ability to generate multicultural scenes, where people and landmarks…