activity
20242026
collaborators

5 papers

cs.CV2026

Pareto-Guided Optimal Transport for Multi-Reward Alignment

Ying Ba, Tianyu Zhang, Mohan Zhou +5

Text-to-image generation models have achieved remarkable progress in preference optimization, yet achieving robust alignment across diverse reward models remains a significant chal…

cs.CV2025

PrefGen: Multimodal Preference Learning for Preference-Conditioned Image Generation

Wenyi Mo, Tianyu Zhang, Yalong Bai +3

Preference-conditioned image generation seeks to adapt generative models to individual users, producing outputs that reflect personal aesthetic choices beyond the given textual pro…

cs.CV2025

Learning User Preferences for Image Generation Model

Wenyi Mo, Ying Ba, Tianyu Zhang +2

User preference prediction requires a comprehensive and accurate understanding of individual tastes. This includes both surface-level attributes, such as color and style, and deepe…

cs.CV2025

Enhancing Reward Models for High-quality Image Generation: Beyond Text-Image Alignment

Ying Ba, Tianyu Zhang, Yalong Bai +4

Contemporary image generation systems have achieved high fidelity and superior aesthetic quality beyond basic text-image alignment. However, existing evaluation frameworks have fai…

cs.CV2024

Uniform Attention Maps: Boosting Image Fidelity in Reconstruction and Editing

Wenyi Mo, Tianyu Zhang, Yalong Bai +2

Text-guided image generation and editing using diffusion models have achieved remarkable advancements. Among these, tuning-free methods have gained attention for their ability to p…