2 papers
cs.CV2026
Can Multimodal Large Language Models Truly Understand Small Objects?
Fujun Han, Junan Chen, Xintong Zhu +4
Multimodal Large Language Models (MLLMs) have shown promising potential in diverse understanding tasks, e.g., image and video analysis, math and physics olympiads. However, they re…
cs.CV2025
Exploring Fourier Prior and Event Collaboration for Low-Light Image Enhancement
Chunyan She, Fujun Han, Chengyu Fang +2
The event camera, benefiting from its high dynamic range and low latency, provides performance gain for low-light image enhancement. Unlike frame-based cameras, it records intensit…