1 paper
Qidong Wang, Junjie Hu, Ming Jiang
Recent advances in causal interpretability have extended from language models to vision-language models (VLMs), seeking to reveal their internal mechanisms through input interventi…