1 citations · 2 across the 3 of their papers we have counts for
Showing 2024Show all
3 papers · 1 filter
cs.CV2024
SSPA: Split-and-Synthesize Prompting with Gated Alignments for Multi-Label Image Recognition
Hao Tan, Zichang Tan, Jun Li +3
Multi-label image recognition is a fundamental task in computer vision. Recently, Vision-Language Models (VLMs) have made notable advancements in this area. However, previous metho…
cs.CL2024★ 1 cited
Factorized Learning Assisted with Large Language Model for Gloss-free Sign Language Translation
Zhigang Chen, Benjia Zhou, Jun Li +5
Previous Sign Language Translation (SLT) methods achieve superior performance by relying on gloss annotations. However, labeling high-quality glosses is a labor-intensive task, whi…
cs.CV2024★ 1 cited
PVLR: Prompt-driven Visual-Linguistic Representation Learning for Multi-Label Image Recognition
Hao Tan, Zichang Tan, Jun Li +2
Multi-label image recognition is a fundamental task in computer vision. Recently, vision-language models have made notable advancements in this area. However, previous methods ofte…