3 papers
cs.CL2025
High-Fidelity Pseudo-label Generation by Large Language Models for Training Robust Radiology Report Classifiers
Brian Wong, Kaito Tanaka
Automated labeling of chest X-ray reports is essential for enabling downstream tasks such as training image-based diagnostic models, population health studies, and clinical decisio…
cs.CV2024
Optimizing Vision-Language Interactions Through Decoder-Only Models
Kaito Tanaka, Benjamin Tan, Brian Wong
Vision-Language Models (VLMs) have emerged as key enablers for multimodal tasks, but their reliance on separate visual encoders introduces challenges in efficiency, scalability, an…
cs.CV2024
An Application-Agnostic Automatic Target Recognition System Using Vision Language Models
Anthony Palladino, Dana Gajewski, Abigail Aronica +8
We present a novel Automatic Target Recognition (ATR) system using open-vocabulary object detection and classification models. A primary advantage of this approach is that target c…