2 papers
cs.CV2025
Learning What Helps: Task-Aligned Context Selection for Vision Tasks
Jingyu Guo, Emir Konuk, Fredrik Strand +2
Humans often resolve visual uncertainty by comparing an image with relevant examples, but ViTs lack the ability to identify which examples would improve their predictions. We prese…
cs.CV2024
Random Token Fusion for Multi-View Medical Diagnosis
Jingyu Guo, Christos Matsoukas, Fredrik Strand +1
In multi-view medical diagnosis, deep learning-based models often fuse information from different imaging perspectives to improve diagnostic performance. However, existing approach…