Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
Not All Tokens and Heads Are Equally Important: Dual-Level Attention Intervention for Hallucination Mitigation
Lexiang Tang, Xianwei Zhuang, Bang Yang +5
Large vision-language models (LVLMs) have demonstrated impressive capabilities across diverse multimodal tasks, yet they remain highly susceptible to visual hallucinations (VH), of…
cs.CV2025
Evaluating and Predicting Distorted Human Body Parts for Generated Images
Lu Ma, Kaibo Cao, Hao Liang +6
Recent advancements in text-to-image (T2I) models enable high-quality image synthesis, yet generating anatomically accurate human figures remains challenging. AI-generated images f…