3 papers
cs.CV2026
DyCoRM: Dynamic Criterion-Aware Reward Modeling for Text-to-Image Generation
Jiaying Qian, Ziheng Jia, Qian Zhang +5
With the continued advancement of text-to-image (T2I) generation, producing high-quality images is becoming increasingly attainable; consequently, user demands are shifting toward…
cs.IR2026
Faithful Evaluation of Semantic-ID Tokenizers for Generative Recommendation
Qian Zhang, Lech Szymanski, Haibo Zhang +1
Generative recommendation based on Semantic IDs (SIDs) represents each item as a discrete sequence of SIDs and is conventionally evaluated by matching the generated SID sequence ag…
cs.CV2026
UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents
Yifan Ji, Zhipeng Xu, Zhenghao Liu +7
Key Information Extraction (KIE) from real-world documents remains challenging due to substantial variations in layout structures, visual quality, and task-specific information req…