4 papers
STORM: Benchmarking Visual Rating of MLLMs with a Comprehensive Ordinal Regression Dataset
Jinhong Wang, Shuo Tong, Jian liu +6
Visual rating is an essential capability of artificial intelligence (AI) for multi-dimensional quantification of visual content, primarily applied in ordinal regression (OR) tasks…
Verification of Electromagnetic Fully-kinetic Symplectic Particle-in-cell Method in Microinstabilities Simulation of
Jianyuan Xiao, Jian liu
We present a symplectic electromagnetic fully-kinetic particle-in-cell simulation of microinstabilities in plasma, using parameters from the Cyclone Base Case [Dimits, et al., Phys…
SyCoCa: Symmetrizing Contrastive Captioners with Attentive Masking for Multimodal Alignment
Ziping Ma, Furong Xu, Jian Liu +2
Multimodal alignment between language and vision is the fundamental topic in current vision-language model research. Contrastive Captioners (CoCa), as a representative method, inte…
Query-Based Knowledge Sharing for Open-Vocabulary Multi-Label Classification
Xuelin Zhu, Jian Liu, Dongqi Tang +4
Identifying labels that did not appear during training, known as multi-label zero-shot learning, is a non-trivial task in computer vision. To this end, recent studies have attempte…