5 papers
ETPDesigner: Multi-Agent Orchestration for Interactive Multimodal Electronic Theater Program
Mengtian Li, Xinru Guo, Xiaoru Lin +3
Electronic Theater Programs (ETPs) serve as critical promotional media in the performing arts, comprising a multi-page collection of heterogeneous visual assets such as theatrical…
SemMorph3D: Unsupervised Semantic-Aware 3D Morphing via Mesh-Guided Gaussians
Mengtian Li, Yunshu Bai, Yimin Chu +4
We introduce METHODNAME, a novel framework for semantic-aware 3D shape and texture morphing directly from multi-view images. While 3D Gaussian Splatting (3DGS) enables photorealist…
Beyond the Dirac Delta: Mitigating Diversity Collapse in Reinforcement Fine-Tuning for Versatile Image Generation
Jinmei Liu, Haoru Li, Zhenhong Sun +6
Reinforcement learning (RL) has emerged as a powerful paradigm for fine-tuning large-scale generative models, such as diffusion and flow models, to align with complex human prefere…
2D Gaussian Splatting with Semantic Alignment for Image Inpainting
Hongyu Li, Chaofeng Chen, Xiaoming Li +1
Gaussian Splatting (GS), a recent technique for converting discrete points into continuous spatial representations, has shown promising results in 3D scene modeling and 2D image su…
MVQA: Mamba with Unified Sampling for Efficient Video Quality Assessment
Yachun Mi, Yu Li, Weicheng Meng +3
The rapid growth of long-duration, high-definition videos has made efficient video quality assessment (VQA) a critical challenge. Existing research typically tackles this problem t…