1 paper
Zhipeng Zhao, Wenxu Wang, Peishun Liu +1
Behavioral benchmarking reveals \emph{what} biases exist in vision-language models but not \emph{which internal components} are most sensitive to targeted intervention, precluding…