4 papers
Generating Multimodal Images with GAN: Integrating Text, Image, and Style
Chaoyi Tan, Wenqing Zhang, Zhen Qi +3
In the field of computer vision, multimodal image generation has become a research hotspot, especially the task of integrating text, image, and style. In this study, we propose a m…
DTSGAN: Learning Dynamic Textures via Spatiotemporal Generative Adversarial Network
Xiangtian Li, Xiaobo Wang, Zhen Qi +3
Dynamic texture synthesis aims to generate sequences that are visually similar to a reference video texture and exhibit specific stationary properties in time. In this paper, we in…
Detecting and Classifying Defective Products in Images Using YOLO
Zhen Qi, Liwei Ding, Xiangtian Li +3
With the continuous advancement of industrial automation, product quality inspection has become increasingly important in the manufacturing process. Traditional inspection methods,…
Real-time Video Target Tracking Algorithm Utilizing Convolutional Neural Networks (CNN)
Chaoyi Tan, Xiangtian Li, Xiaobo Wang +2
Thispaperaimstoresearchandimplementa real-timevideotargettrackingalgorithmbasedon ConvolutionalNeuralNetworks(CNN),enhancingthe accuracyandrobustnessoftargettrackingincomplex scena…