2 papers
cs.CV2025
Walking the Schrödinger Bridge: A Direct Trajectory for Text-to-3D Generation
Ziying Li, Xuequan Lu, Xinkui Zhao +3
Recent advancements in optimization-based text-to-3D generation heavily rely on distilling knowledge from pre-trained text-to-image diffusion models using techniques like Score Dis…
cs.AI2025
Collaborative Text-to-Image Generation via Multi-Agent Reinforcement Learning and Semantic Fusion
Jiabao Shi, Minfeng Qi, Lefeng Zhang +5
Multimodal text-to-image generation remains constrained by the difficulty of maintaining semantic alignment and professional-level detail across diverse visual domains. We propose…