Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
MV-CoRe: Multimodal Visual-Conceptual Reasoning for Complex Visual Question Answering
Jingwei Peng, Jiehao Chen, Mateo Alejandro Rojas +1
Complex Visual Question Answering (Complex VQA) tasks, which demand sophisticated multi-modal reasoning and external knowledge integration, present significant challenges for exist…
cs.CV2024
Enhancing Scientific Figure Captioning Through Cross-modal Learning
Mateo Alejandro Rojas, Rafael Carranza
Scientific charts are essential tools for effectively communicating research findings, serving as a vital medium for conveying information and revealing data patterns. With the rap…