2 papers
cs.CV2026
Beyond Post-Quantization: Native Hash Learning with a Dedicated HASH Token
Xinze Liu, Ding Wang, Hengjie Zhu +4
Efficient large-scale image retrieval requires compact representations that preserve semantic similarity under fast Hamming-space search. Deep hashing is appealing, but most existi…
cs.CV2025
Critique Before Thinking: Mitigating Hallucination through Rationale-Augmented Instruction Tuning
Zexian Yang, Dian Li, Dayan Wu +2
Despite significant advancements in multimodal reasoning tasks, existing Large Vision-Language Models (LVLMs) are prone to producing visually ungrounded responses when interpreting…