multimodal question answering 1policy optimization 1post-training 1reinforcement learning 1visual grounding 1
From the 1 of 2 linked papers with an AI index.
2 papers
cs.AI2026
Stop Thinking, Start Looking: Efficient Post-Training for Multimodal Document Question Answering via Reasoning-Free Alignment
Harikrishnan P M, Goutham Vignesh, Ganesh Parab +4
The paper proposes Perception-RFT, a post‑training framework that uses Group Relative Policy Optimization to align visual features with grounding outputs for multimodal document qu…
cs.LG2025
HI-SQL: Optimizing Text-to-SQL Systems through Dynamic Hint Integration
Ganesh Parab, Zishan Ahmad, Dagnachew Birru
Text-to-SQL generation bridges the gap between natural language and databases, enabling users to query data without requiring SQL expertise. While large language models (LLMs) have…