1 paper
Naoki Yoshida, Satoshi Hayakawa, Yuhta Takida +3
In this study, we propose an enhancement to the similarity computation mechanism in multi-modal contrastive pretraining frameworks such as CLIP. Prior theoretical research has demo…