2 papers
cs.CV2025
Generating Multimodal Images with GAN: Integrating Text, Image, and Style
Chaoyi Tan, Wenqing Zhang, Zhen Qi +3
In the field of computer vision, multimodal image generation has become a research hotspot, especially the task of integrating text, image, and style. In this study, we propose a m…
cs.CV2024
Real-time Video Target Tracking Algorithm Utilizing Convolutional Neural Networks (CNN)
Chaoyi Tan, Xiangtian Li, Xiaobo Wang +2
Thispaperaimstoresearchandimplementa real-timevideotargettrackingalgorithmbasedon ConvolutionalNeuralNetworks(CNN),enhancingthe accuracyandrobustnessoftargettrackingincomplex scena…