collaborators

7 papers

cs.CV2025

A Preliminary Study on GPT-Image Generation Model for Image Restoration

Hao Yang, Yan Yang, Ruikun Zhang +1

Recent advances in OpenAI's GPT-series multimodal generation models have shown remarkable capabilities in producing visually compelling images. In this work, we investigate its pot…

cs.CV2025

From Spots to Pixels: Dense Spatial Gene Expression Prediction from Histology Images

Ruikun Zhang, Yan Yang, Liyuan Pan

Spatial transcriptomics (ST) measures gene expression at fine-grained spatial resolution, offering insights into tissue molecular landscapes. Previous methods for spatial gene expr…

cs.CV2025

ProBench: Judging Multimodal Foundation Models on Open-ended Multi-domain Expert Tasks

Yan Yang, Dongxu Li, Haoning Wu +4

Solving expert-level multimodal tasks is a key milestone towards general intelligence. As the capabilities of multimodal large language models (MLLMs) continue to improve, evaluati…

cs.CV2024

EZSR: Event-based Zero-Shot Recognition

Yan Yang, Liyuan Pan, Dongxu Li +1

This paper studies zero-shot object recognition using event camera data. Guided by CLIP, which is pre-trained on RGB images, existing approaches achieve zero-shot object recognitio…

cs.CV2024

SpikMamba: When SNN meets Mamba in Event-based Human Action Recognition

Jiaqi Chen, Yan Yang, Shizhuo Deng +2

Human action recognition (HAR) plays a key role in various applications such as video analysis, surveillance, autonomous driving, robotics, and healthcare. Most HAR algorithms are…

cs.CV2024

LMHaze: Intensity-aware Image Dehazing with a Large-scale Multi-intensity Real Haze Dataset

Ruikun Zhang, Hao Yang, Yan Yang +2

Image dehazing has drawn a significant attention in recent years. Learning-based methods usually require paired hazy and corresponding ground truth (haze-free) images for training.…