5 papers
CheXmix: Unified Generative Pretraining for Vision Language Models in Medical Imaging
Ashwin Kumar, Robbie Holland, Corey Barrett +8
Recent medical multimodal foundation models are built as multimodal LLMs (MLLMs) by connecting a CLIP-pretrained vision encoder to an LLM using LLaVA-style finetuning. This two-sta…
RadAgents: Multimodal Agentic Reasoning for Chest X-ray Interpretation with Radiologist-like Workflows
Kai Zhang, Corey D Barrett, Jangwon Kim +3
Agentic systems offer a potential path to solve complex clinical tasks through collaboration among specialized agents, augmented by tool use and external knowledge bases. Neverthel…
Optimizing Long-Form Clinical Text Generation with Claim-Based Rewards
Samyak Jhaveri, Praphul Singh, Jangwon Kim +2
Automating clinical documentation with large language models requires precise alignment with priorities such as completeness and factual grounding. We present an evaluation-integra…
RedactOR: An LLM-Powered Framework for Automatic Clinical Data De-Identification
Praphul Singh, Charlotte Dzialo, Jangwon Kim +4
Ensuring clinical data privacy while preserving utility is critical for AI-driven healthcare and data analytics. Existing de-identification (De-ID) methods, including rule-based te…
A dataset and benchmark for hospital course summarization with adapted large language models
Asad Aali, Dave Van Veen, Yamin Ishraq Arefeen +9
Brief hospital course (BHC) summaries are clinical documents that summarize a patient's hospital stay. While large language models (LLMs) depict remarkable capabilities in automati…