1 paper
Pengpeng Zeng, Jinkuan Zhu, Jingkuan Song +1
Studies of image captioning are shifting towards a trend of a fully end-to-end paradigm by leveraging powerful visual pre-trained models and transformer-based generation architectu…