3 citations · 3 across the 2 of their papers we have counts for
3 papers
cs.LG2026
MESH: Memory-Efficient Sinkhorn Optimization for Mixture-of-Experts Training
Masato Fujitake
Memory-efficient matrix optimizers such as Sinkhorn gradient descent remove most AdamW optimizer state for dense Transformer matrices, but direct application to Mixture-of-Experts…
cs.CV2023★ 3 cited
DTrOCR: Decoder-only Transformer for Optical Character Recognition
Masato Fujitake
Typical text recognition methods rely on an encoder-decoder structure, in which the encoder extracts features from an image, and the decoder produces recognized text from these fea…
cs.CV2023
DiffusionSTR: Diffusion Model for Scene Text Recognition
Masato Fujitake
This paper presents Diffusion Model for Scene Text Recognition (DiffusionSTR), an end-to-end text recognition framework using diffusion models for recognizing text in the wild. Whi…