1 citations · 1 across the 3 of their papers we have counts for
3 papers
cs.CV2025
Interpreting Attention Heads for Image-to-Text Information Flow in Large Vision-Language Models
Jinyeong Kim, Seil Kang, Jiwoo Park +2
Large Vision-Language Models (LVLMs) answer visual questions by transferring information from images to text through a series of attention heads. While this image-to-text informati…
cs.LG2025
Backbone Augmented Training for Adaptations
Jae Wan Park, Junhyeok Kim, Youngjun Jun +2
Adaptations facilitate efficient training of large backbone models, including diffusion models for image generation and transformer-based language models. While various adaptation…
cs.AI2024★ 1 cited
WoLF: Wide-scope Large Language Model Framework for CXR Understanding
Seil Kang, Donghyun Kim, Junhyeok Kim +2
Significant methodological strides have been made toward Chest X-ray (CXR) understanding via modern vision-language models (VLMs), demonstrating impressive Visual Question Answerin…