3 papers
cs.IR2026
QKVQA: Question-Focused Filtering for Knowledge-based VQA
Wei Ye, Yixin Su, Yueguo Chen +4
Visual Question Answering (VQA) is the task of answering questions based on image content. Building upon this, Knowledge-Based VQA (KB-VQA) requires models to answer questions that…
cs.DC2025
Distributed Retrieval-Augmented Generation
Chenhao Xu, Longxiang Gao, Yuan Miao +1
As large language models (LLMs) become increasingly adopted on edge devices, Retrieval-Augmented Generation (RAG) is gaining prominence as a solution to address factual deficiencie…
cs.RO2025
Spatial-Temporal Graph Diffusion Policy with Kinematic Modeling for Bimanual Robotic Manipulation
Qi Lv, Hao Li, Xiang Deng +6
Despite the significant success of imitation learning in robotic manipulation, its application to bimanual tasks remains highly challenging. Existing approaches mainly learn a poli…