1 paper
Chang Liu, Jiawei Zhang, Tao Zhang +3
Current vision-language-action (VLA) benchmarks primarily evaluate isolated manipulation skills while leaving human-robot interaction structure largely unmodeled. However, real-wor…