1 paper · 1 filter
Jiani Zheng, Zhiyang Teng, Kunpeng Qiu +6
Unified Vision-Language Models (UVLMs) perform both understanding and generation within a single architecture. Since these models rely on heterogeneous data and supervision, balanc…