2 papers
cs.CV2026
ACPO: Counteracting Likelihood Displacement in Vision-Language Alignment with Asymmetric Constraints
Kaili Huang, Hongming Zhang, Rui Shen +4
While Direct Preference Optimization (DPO) has become the de facto approach for aligning Large Vision-Language Models (LVLMs), it suffers from Likelihood Displacement, where the pr…
cs.AI2025
Wonderful Team: Zero-Shot Physical Task Planning with Visual LLMs
Zidan Wang, Rui Shen, Bradly Stadie
We introduce Wonderful Team, a multi-agent Vision Large Language Model (VLLM) framework for executing high-level robotic planning in a zero-shot regime. In our context, zero-shot h…