4 papers
Autoregressive Styled Text Image Generation, but Make it Reliable
Carmine Zaccagnino, Fabio Quattrini, Vittorio Pippi +3
Generating faithful and readable styled text images (especially for Styled Handwritten Text generation - HTG) is an open problem with several possible applications across graphic d…
Quo Vadis Handwritten Text Generation for Handwritten Text Recognition?
Vittorio Pippi, Konstantina Nikolaidou, Silvia Cascianelli +4
The digitization of historical manuscripts presents significant challenges for Handwritten Text Recognition (HTR) systems, particularly when dealing with small, author-specific col…
Zero-Shot Styled Text Image Generation, but Make It Autoregressive
Vittorio Pippi, Fabio Quattrini, Silvia Cascianelli +2
Styled Handwritten Text Generation (HTG) has recently received attention from the computer vision and document analysis communities, which have developed several solutions, either…
ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task
Vittorio Pippi, Matthieu Guillaumin, Silvia Cascianelli +3
Large Multimodal Models (LMMs) are powerful tools that are capable of reasoning and understanding multimodal information beyond text and language. Despite their entrenched impact,…