agentic decision rules 1evolutionary search 1inference-time aggregation 1medical visual question answering 1medical VQA 1model calibration 1multi-frame VQA 1multi-image reasoning 1robust adaptation 1supervised fine-tuning 1
From the 2 of 3 linked papers with an AI index.
3 papers
cs.CV2026
Objective-Aligned Direct Answer SFT for Robust Multi-Frame Medical VQA
Site Li, Jianyi Hao, Xiaofeng Liu
The paper evaluates different adaptation strategies for multi-frame medical visual question answering and finds that a simple objective-aligned direct answer supervised fine-tuning…
cs.CV2026
Inference-Time Agentic Decision Rules Beat Longer Evolving Search for Multi-Image Medical Reasoning
Site Li, Jianyi Hao, Xiaofeng Liu
The paper evaluates different inference-time decision strategies for multi-image medical visual question answering, finding that a simple order-vote aggregation rule outperforms mo…
cs.LG2024
Optimal Control-Based Baseline for Guided Exploration in Policy Gradient Methods
Xubo Lyu, Site Li, Seth Siriya +2
In this paper, a novel optimal control-based baseline function is presented for the policy gradient method in deep reinforcement learning (RL). The baseline is obtained by computin…