3 papers
cs.CV2026
DyCoRM: Dynamic Criterion-Aware Reward Modeling for Text-to-Image Generation
Jiaying Qian, Ziheng Jia, Qian Zhang +5
With the continued advancement of text-to-image (T2I) generation, producing high-quality images is becoming increasingly attainable; consequently, user demands are shifting toward…
cs.IR2026
How Reliable Are Semantic-ID Tokenizer Comparisons in Generative Recommendation?
Qian Zhang, Lech Szymanski, Haibo Zhang +1
In Semantic-ID (SID) based generative recommendation, each item is represented as a sequence of discrete codes, and an autoregressive model is trained to generate the SID sequence…
cs.CV2026
UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents
Yifan Ji, Zhipeng Xu, Zhenghao Liu +7
Key Information Extraction (KIE) from real-world documents remains challenging due to substantial variations in layout structures, visual quality, and task-specific information req…