5 papers
LumiVideo: An Intelligent Agentic System for Video Color Grading
Yuchen Guo, Junli Gong, Hongmin Cai +2
Video color grading is a critical post-production process that transforms flat, log-encoded raw footage into emotionally resonant cinematic visuals. Existing automated methods act…
S-VGGT: Structure-Aware Subscene Decomposition for Scalable 3D Foundation Models
Xinze Li, Pengxu Chen, Yiyuan Wang +2
Feed-forward 3D foundation models face a key challenge: the quadratic computational cost introduced by global attention, which severely limits scalability as input length increases…
DDO-IN: Dual Domains Optimization for Implicit Neural Network to Eliminate Motion Artifact in Magnetic Resonance Imaging
Zhongyu Mai, Zewei Zhan, Hanyu Guo +2
Magnetic resonance imaging (MRI) motion artifacts can seriously affect clinical diagnostics, making it challenging to interpret images accurately. Existing methods for eliminating…
Fuse4Seg: Image Fusion for Multi-Modal Medical Segmentation via Bi-level Optimization
Yuchen Guo, Junli Gong, Hongmin Cai +2
Multi-modal medical image fusion is traditionally optimized for human visual perception, aiming to maximize generic contrast and structural fidelity. However, when these visually p…
DAE-Fuse: An Adaptive Discriminative Autoencoder for Multi-Modality Image Fusion
Yuchen Guo, Ruoxiang Xu, Rongcheng Li +1
In extreme scenarios such as nighttime or low-visibility environments, achieving reliable perception is critical for applications like autonomous driving, robotics, and surveillanc…