activity
20242026
most citedEPMF: Efficient Perception-aware Multi-sensor Fusion for 3D Semantic Segmentation

44 citations · 44 across the 7 of their papers we have counts for

collaborators

35 papers

cs.RO2026

ViTacPhys: Physical Property-Aware Grasping from Human Visual-Tactile Demonstrations

Yiwen Liu, Yujun Zhu, Kui Jia +3

Recent vision-based action models have demonstrated strong capabilities in complex manipulation, but they rarely leverage explicit object physical properties to adapt their policie…

math.CO2026

Layer barriers for colour-biased tight Hamilton cycles

Zijian Deng, Qinfei Tang, Caihong Yang

We construct a family of layer barriers for colour-biased tight Hamilton cycles in uniform hypergraphs. For every and every , we give a red--blue col…

cs.RO2026

Vid2WAM: Distilling Video Diffusion Priors into World Action Models

Chenhao Qiu, Ruixiang Wang, Runyi Zhao +7

World Action Models (WAMs) improve robot policy learning by jointly modeling future visual dynamics and actions. However, their scalability and generalization remain constrained by…

cs.RO2026

BiNoMaP: Learning Category-Level Bimanual Non-Prehensile Manipulation Primitives

Huayi Zhou, Kui Jia

Non-prehensile manipulation, encompassing ungraspable actions such as pushing, poking, pivoting, and wrapping, remains underexplored due to its contact-rich and analytically intrac…

cs.CV202644 cited

EPMF: Efficient Perception-aware Multi-sensor Fusion for 3D Semantic Segmentation

Mingkui Tan, Zhuangwei Zhuang, Sitao Chen +4

We study multi-sensor fusion for 3D semantic segmentation that is important to scene understanding for many applications, such as autonomous driving and robotics. Existing fusion-b…

cs.RO2026

Dexterity-BEV: Aligning 3D World and Actions for Generalizable Robot Policies Learning

Huayi Zhou, Wei Gao, Dekun Lu +12

End-to-end manipulation policies, combined with web-scale pretrained Vision-Language Models (VLMs), show the promise for generalizable and dexterous robotic manipulation. However,…