3 papers
cs.CV2025
Reasoning under Vision: Understanding Visual-Spatial Cognition in Vision-Language Models for CAPTCHA
Python Song, Luke Tenyi Chang, Yun-Yun Tsai +2
CAPTCHA, originally designed to distinguish humans from robots, has evolved into a real-world benchmark for assessing the spatial reasoning capabilities of vision-language models.…
cs.LG2025
RAFP: Identifying LLM Lineages via Rare-Region Fingerprints
Yun-Yun Tsai, Jia Hao Liang, Chuan Guo +2
Large language models (LLMs) are increasingly released under restricted licenses, creating a growing need for robust model ownership verification. Existing fingerprinting methods a…
cs.CV2024
GDA: Generalized Diffusion for Robust Test-time Adaptation
Yun-Yun Tsai, Fu-Chen Chen, Albert Y. C. Chen +4
Machine learning models struggle with generalization when encountering out-of-distribution (OOD) samples with unexpected distribution shifts. For vision tasks, recent studies have…