1 paper
Xixi Jiang, Chen Yang, Dong Zhang +3
Vision Transformer models have shown impressive effectiveness in the surgical video understanding tasks through long-range dependency modeling. However, current methods suffer from…