2 papers
cs.CV2026
MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing
Zhaoyuan Qiu, Ken Chen, Xiangwei Wang +3
Existing instruction-based image editing models perform well with simple, single-step instructions but degrade in realistic scenarios that involve multiple, lengthy, and interdepen…
cs.CV2025
Beyond Deepfake vs Real: Facial Deepfake Detection in the Open-Set Paradigm
Nadarasar Bahavan, Sachith Seneviratne, Sanjay Saha +3
Facial forgery methods such as deepfakes can be misused for identity manipulation and spreading misinformation. They have evolved alongside advancements in generative AI, leading t…