1 paper
Sid Bharthulwar, John Rho, Katrina Brown
We present a framework for optimizing prompts in vision-language models to elicit multimodal reasoning without model retraining. Using an evolutionary algorithm to guide prompt upd…