Showing cs.CVShow all
3 papers · 1 filter
cs.CV2026
M3: High-fidelity Text-to-Image Generation via Multi-Modal, Multi-Agent and Multi-Round Visual Reasoning
Bangji Yang, Ruihan Guo, Jiajun Fan +2
Generative models have achieved impressive fidelity in text-to-image synthesis, yet struggle with complex compositional prompts involving multiple constraints. We introduce \textbf…
cs.CV2025
RSeg: Training-Free OOD Medical Tumor Segmentation via Anatomical Reasoning and Statistical Rejection
Shuaike Shen, Ke Liu, Jiaqing Xie +5
Foundation models for medical image segmentation struggle under out-of-distribution (OOD) shifts, often producing fragmented false positives on OOD tumors. We introduce RSeg,…
cs.CV2024
Geometric Point Attention Transformer for 3D Shape Reassembly
Jiahan Li, Chaoran Cheng, Jianzhu Ma +1
Shape assembly, which aims to reassemble separate parts into a complete object, has gained significant interest in recent years. Existing methods primarily rely on networks to pred…