2 papers
cs.CV2026
HoloGeo: Mitigating Landmark Bias in Geo-localization via Evidence-Driven Reasoning
Pengcheng Zhou, Xuanyu Liu, Yanchen Yin +4
Recent advances in Vision-Language Models (VLMs) have significantly improved image geo-localization, yet existing models remain susceptible to landmark bias, causing them to overlo…
cs.CR2026
Robust Harmful Features Under Jailbreak Attacks: Mechanistic Evidence from Attention Head Specialization in Large Language Models
Yanchen Yin, Dongqi Han, Linghui Li
Jailbreak attacks bypass LLM safety alignment, yet their mechanisms remain poorly understood. We provide evidence that attacks do not comprehensively eliminate safety features, but…