5 papers
Detecting AI-Generated Videos with Spiking Neural Networks
Minsuk Jang, Yujin Yang, Heeseon Kim +4
Modern AI-generated videos are photorealistic at the single-frame level, leaving inter-frame dynamics as the main remaining axis for detection. Existing detectors typically handle…
Multimodal Self-Attention Network with Temporal Alignment for Audio-Visual Emotion Recognition
Inyong Koo, yeeun Seong, Minseok Son +2
Audio-visual emotion recognition (AVER) methods typically fuse utterance-level features, and even frame-level attention models seldom address the frame-rate mismatch across modalit…
Detecting AI-Generated Images via Contextual Anomaly Estimation in Masked AutoEncoders
Minsuk Jang, Hyunseo Jeong, Minseok Son +1
Context-based detection methods such as DetectGPT achieve strong generalization in identifying AI-generated text by evaluating content compatibility with a model's learned distribu…
Towards Efficient Vision State Space Models via Token Merging
Jinyoung Park, Minseok Son, Changick Kim
State Space Models (SSMs) have emerged as powerful architectures in computer vision, yet improving their computational efficiency remains crucial for practical and scalable deploym…
Difficulty-aware Balancing Margin Loss for Long-tailed Recognition
Minseok Son, Inyong Koo, Jinyoung Park +1
When trained with severely imbalanced data, deep neural networks often struggle to accurately recognize classes with only a few samples. Previous studies in long-tailed recognition…