3 papers
cs.CV2024
Motion Prompting: Controlling Video Generation with Motion Trajectories
Daniel Geng, Charles Herrmann, Junhwa Hur +11
Motion control is crucial for generating expressive and compelling video content; however, most existing video generation models rely mainly on text prompts for control, which stru…
cs.CV2024
RadFlag: A Black-Box Hallucination Detection Method for Medical Vision Language Models
Serena Zhang, Sraavya Sambara, Oishi Banerjee +3
Generating accurate radiology reports from medical images is a clinically important but challenging task. While current Vision Language Models (VLMs) show promise, they are prone t…
cs.CL2024
ReXErr: Synthesizing Clinically Meaningful Errors in Diagnostic Radiology Reports
Vishwanatha M. Rao, Serena Zhang, Julian N. Acosta +2
Accurately interpreting medical images and writing radiology reports is a critical but challenging task in healthcare. Both human-written and AI-generated reports can contain error…