2 papers
cs.CV2025
CLIP Brings Better Features to Visual Aesthetics Learners
Liwu Xu, Jinjin Xu, Yuzhe Yang +3
Image Aesthetics Assessment (IAA) is a challenging task due to its subjective nature and expensive manual annotations. Recent large-scale vision-language models, such as Contrastiv…
cs.CV2024
u-LLaVA: Unifying Multi-Modal Tasks via Large Language Model
Jinjin Xu, Liwu Xu, Yuzhe Yang +5
Recent advancements in multi-modal large language models (MLLMs) have led to substantial improvements in visual understanding, primarily driven by sophisticated modality alignment…