1 paper · 1 filter
Rui Tang, Wentao Yang, Peirong Zhang +4
The paper introduces a vision-centric framework called SPaTS that uses a single visual token per text instance and reinforcement learning to improve scene text spotting accuracy an…