2 papers
cs.CV2026
EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning
Xuan Ju, Tianyu Wang, Yuqian Zhou +11
Recent advances in foundation models highlight a clear trend toward unification and scaling, showing emergent capabilities across diverse domains. While image generation and editin…
cs.CV2024
FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing
Youyuan Zhang, Xuan Ju, James J. Clark
Diffusion models have demonstrated remarkable capabilities in text-to-image and text-to-video generation, opening up possibilities for video editing based on textual input. However…