2 papers
cs.CV2026
Self-Improving Small Object Grounding in LVLMs
Tianze Yang, Yucheng Shi, Ruitong Sun +2
Can internal attention patterns in Large Vision Language Models (LVLMs) identify reliable small-object boxes without fine-tuning? In this work, we provide an affirmative answer. At…
cs.AI2026
TRON: Targeted Rule-Verifiable Online Environments for Visual Reasoning RL
Tianze Yang, Yucheng Shi, Ruitong Sun +3
Reinforcement learning (RL) for visual reasoning needs scalable, verifiable, and controllable training signals. Existing visual RL post-training trains on static curated datasets,…