2 papers
cs.CV2025
Motion Prompting: Controlling Video Generation with Motion Trajectories
Daniel Geng, Charles Herrmann, Junhwa Hur +11
Motion control is crucial for generating expressive and compelling video content; however, most existing video generation models rely mainly on text prompts for control, which stru…
cs.CV2024
RadFlag: A Black-Box Hallucination Detection Method for Medical Vision Language Models
Serena Zhang, Sraavya Sambara, Oishi Banerjee +3
Generating accurate radiology reports from medical images is a clinically important but challenging task. While current Vision Language Models (VLMs) show promise, they are prone t…