2 papers
cs.CV2026
Element-Aware Group Learning for E-Commerce Image Generation
Jingtong Chen, Jiahui Wang, Xue Zhao +2
Recent advances in image generation and editing have made prompt quality a key bottleneck for e-commerce creatives. Vision-language models (VLMs) can generate image-editing prompts…
cs.CV2026
CoVEBench: Can Video Editing Models Handle Complex Instructions?
Jiangtao Wu, Jiaming Wang, Yiwen He +7
While recent text-guided video editing models excel at elementary tasks (e.g., style transfer, object insertion), real-world user requests are highly compositional. A single prompt…