From the 2 of 12 linked papers with an AI index.
12 papers
Learning Color Grading, No Photo Sharing: Federated Aesthetic Preference Learning for Personalized Image Enhancement
Chuanzhi Xu, Ziyuan Tao, Jean Julien KNell +5
The paper proposes FedPAIE, a federated learning framework that learns individual aesthetic preferences for color grading and applies lightweight, personalized image enhancement on…
SciFigAlign: Scoring Scientific Figures by Fine-tuned Alignment of Visuals with Manuscript Evidence
Chuanzhi Xu, Zihan Deng, Huiqi Liang +4
The paper introduces SciFigAlign, a multimodal model that scores scientific figures by aligning visual content with manuscript evidence, using fine‑tuned CLIP and SciBERT to predic…
A First Exploration of Neuromorphic OT-CFM for Multi-Speaker VSR
Lin Chen, Jingping Fang, Hairui Liu +5
Visual Speech Recognition (VSR) tasks in complex multi-speaker scenarios are severely hindered by rapid head motions, occlusions, and subtle lip articulations. Traditional RGB-base…
EvLIR: Learning Illumination Residuals from Ordered Events for Low-Light Image Enhancement
Haoxian Zhou, Chuanzhi Xu, Langyi Chen +5
Low-light image enhancement is severely ill-posed when the input frame contains missing structure, saturated noise, and weak local contrast. Event cameras provide asynchronous brig…
SAFE-DiT: Semantics-Aware Fast-path Execution for High-Resolution Diffusion Transformers
Xuanhua Yin, Yuxuan Jia, Chuanzhi Xu +1
High-resolution Diffusion Transformer (DiT) inference contains substantial spatial redundancy, but many spatially adaptive implementations encode regional computation as attention…
AccelAes: Accelerating Diffusion Transformers for Training-Free Aesthetic-Enhanced Image Generation
Xuanhua Yin, Chuanzhi Xu, Haoxian Zhou +2
Diffusion Transformers (DiTs) are a dominant backbone for high-fidelity text-to-image generation due to strong scalability and alignment at high resolutions. However, quadratic sel…