Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
Systematic Evaluation and Guidelines for Segment Anything Model in Surgical Video Analysis
Cheng Yuan, Jian Jiang, Kunyi Yang +11
Surgical video segmentation is critical for AI to interpret spatial-temporal dynamics in surgery, yet model performance is constrained by limited annotated data. The SAM2 model, pr…
cs.CV2025
NextStep-1: Toward Autoregressive Image Generation with Continuous Tokens at Scale
NextStep Team, Chunrui Han, Guopeng Li +47
Prevailing autoregressive (AR) models for text-to-image generation either rely on heavy, computationally-intensive diffusion models to process continuous image tokens, or employ ve…