1 paper
Calvin Galagain, Martyna Poreba, François Goulette
Query-based Vision Transformer segmentation models typically reconstruct dense spatial feature maps to predict masks, inheriting design patterns from convolutional architectures. W…