3 papers
cs.CL2026
From Attribution to Abstention: Training-Free Attention-Based Auditing for Clinical Summarization
Qianqi Yan, Huy Nguyen, Sumana Srivatsa +3
Deploying multimodal large language models (MLLMs) for clinical summarization demands not only fluent generation but also transparency about where each statement originates-and a m…
cs.CV2025
Enhancing Vietnamese VQA through Curriculum Learning on Raw and Augmented Text Representations
Khoi Anh Nguyen, Linh Yen Vu, Thang Dinh Duong +3
Visual Question Answering (VQA) is a multimodal task requiring reasoning across textual and visual inputs, which becomes particularly challenging in low-resource languages like Vie…
cs.CL2025
RAPID: Retrieval-Augmented Parallel Inference Drafting for Text-Based Video Event Retrieval
Long Nguyen, Huy Nguyen, Bao Khuu +4
Retrieving events from videos using text queries has become increasingly challenging due to the rapid growth of multimedia content. Existing methods for text-based video event retr…