From the 1 of 5 linked papers with an AI index.
5 papers
FAS-R1: A Unified Multi-Task MLLM for Reasoning Face Anti-Spoofing
Hongyang Wang, Yichen Shi, Hongrui Li +3
The paper introduces FAS-R1, a two‑stage multimodal large language model that simultaneously classifies face authenticity, identifies attack types, and localizes spoof regions, usi…
WeGenBench: A Multidimensional Diagnostic Benchmark towards Text-to-Image Model Optimization
Qian Liang, Xiaomin Li, Ying Zhang +6
Recent text-to-image generation models have demonstrated remarkable capabilities in synthesizing highly realistic images from text inputs alone. Although existing benchmarks can ev…
UniShield: Unified Face Attack Detection via KG-Informed Multimodal Reasoning
Hongrui Li, Yichen Shi, Hongyang Wang +4
Unified face attack detection (UAD) requires recognizing physical spoofing and digital forgery within a shared decision space, yet existing discriminative or prompt-based methods l…
ZEBRA: Towards Zero-Shot Cross-Subject Generalization for Universal Brain Visual Decoding
Haonan Wang, Jingyu Lu, Hongrui Li +1
Recent advances in neural decoding have enabled the reconstruction of visual experiences from brain activity, positioning fMRI-to-image reconstruction as a promising bridge between…
Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant
Haonan Wang, Jiaji Mao, Lehan Wang +11
Medical AI assistants support doctors in disease diagnosis, medical image analysis, and report generation. However, they still face significant challenges in clinical use, includin…