1 paper
Sami Baral, Li Lucy, Ryan Knight +4
In real-world settings, vision language models (VLMs) should robustly handle naturalistic, noisy visual content as well as domain-specific language and concepts. For example, K-12…