7 papers
GraphPL: Leveraging GNN for Efficient and Robust Modalities Imputation in Patchwork Learning
Xingjian Hu, Zuoyu Yan, Jianhua Zhu +3
Current research on distributed multi-modal learning typically assumes that clients can access complete information across all modalities, which may not hold in practice. In this p…
Clair Obscur: an Illumination-Aware Method for Real-World Image Vectorization
Xingyue Lin, Shuai Peng, Xiangyu Xie +3
Image vectorization aims to convert raster images into editable, scalable vector representations while preserving visual fidelity. Existing vectorization methods struggle to repres…
Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition
Yu Li, Jin Jiang, Jianhua Zhu +4
Handwritten Mathematical Expression Recognition (HMER) remains a persistent challenge in Optical Character Recognition (OCR) due to the inherent freedom of symbol layouts and varia…
Do Large Language Models Excel in Complex Logical Reasoning with Formal Language?
Jin Jiang, Jianing Wang, Yuchen Yan +5
Large Language Models (LLMs) have been shown to achieve breakthrough performance on complex logical reasoning tasks. Nevertheless, most existing research focuses on employing forma…
SketchRef: a Multi-Task Evaluation Benchmark for Sketch Synthesis
Xingyue Lin, Xingjian Hu, Shuai Peng +2
Sketching is a powerful artistic technique for capturing essential visual information about real-world objects and has increasingly attracted attention in image synthesis research.…
TAMER: Tree-Aware Transformer for Handwritten Mathematical Expression Recognition
Jianhua Zhu, Wenqi Zhao, Yu Li +2
Handwritten Mathematical Expression Recognition (HMER) has extensive applications in automated grading and office automation. However, existing sequence-based decoding methods, whi…