1 paper · 1 filter
Yitong Quan, Benjamin Kiefer, Martin Messmer +1
Modern image-based object detection models, such as YOLOv7, primarily process individual frames independently, thus ignoring valuable temporal context naturally present in videos.…