2 papers
cs.CL2026
Visual Search Augmented Chain-of-Thought Reasoning for Attribute Value Extraction from Product Videos
Tong Wu, Ming Cheng, Jiazhen Hu +2
Existing approaches to visual attribute value extraction (AVE) primarily rely on static product images, failing to capture temporal cues, multi-angle views and fine-grained visual…
cs.CV2025
VideoAVE: A Multi-Attribute Video-to-Text Attribute Value Extraction Dataset and Benchmark Models
Ming Cheng, Tong Wu, Jiazhen Hu +2
Attribute Value Extraction (AVE) is important for structuring product information in e-commerce. However, existing AVE datasets are primarily limited to text-to-text or image-to-te…