Showing cs.CVShow all
3 papers · 1 filter
cs.CV2025
RMLer: Synthesizing Novel Objects across Diverse Categories via Reinforcement Mixing Learning
Jun Li, Zikun Chen, Haibo Chen +2
Novel object synthesis by integrating distinct textual concepts from diverse categories remains a significant challenge in Text-to-Image (T2I) generation. Existing methods often su…
cs.CV2025
VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis
Zeren Xiong, Yue Yu, Zedong Zhang +3
Creating novel images by fusing visual cues from multiple sources is a fundamental yet underexplored problem in image-to-image generation, with broad applications in artistic creat…
cs.CV2024
PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
Zheng Li, Xiang Li, Xinyi Fu +4
Prompt learning has emerged as a valuable technique in enhancing vision-language models (VLMs) such as CLIP for downstream tasks in specific domains. Existing work mainly focuses o…