1 paper · 1 filter
Andrea Maracani, Savas Ozkan, Sijun Cho +6
Scaling architectures have been proven effective for improving Scene Text Recognition (STR), but the individual contribution of vision encoder and text decoder scaling remain under…