1 paper · 1 filter
Gaoyue Zhou, Zichen Jeff Cui, Ada Langford +3
Pretrained dense visual features from Vision Transformers (ViTs) are powerful yet have been underutilized in robot learning. Modern robot policies either compress each observation…