3 citations · 4 across the 3 of their papers we have counts for
3 papers
cs.CL2025
Towards Text-Image Interleaved Retrieval
Xin Zhang, Ziqi Dai, Yongqi Li +7
Current multimodal information retrieval studies mainly focus on single-image inputs, which limits real-world applications involving multiple images and text-image interleaved cont…
cs.CL2025★ 1 cited
FilmAgent: A Multi-Agent Framework for End-to-End Film Automation in Virtual 3D Spaces
Zhenran Xu, Longyue Wang, Jifang Wang +7
Virtual film production requires intricate decision-making processes, including scriptwriting, virtual cinematography, and precise actor positioning and actions. Motivated by recen…
cs.CL2025★ 3 cited
KaLM-Embedding: Superior Training Data Brings A Stronger Embedding Model
Xinshuo Hu, Zifei Shan, Xinping Zhao +10
As retrieval-augmented generation prevails in large language models, embedding models are becoming increasingly crucial. Despite the growing number of general embedding models, pri…