Publications (52)
Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives
Kristen Grauman, Andrew Westbury, Lorenzo Torresani +98
ERF: Explicit Radiance Field Reconstruction From Scratch
Samir Aroudj, Steven Lovegrove, Eddy Ilg +3
EgoLM: Multi-Modal Language Model of Egocentric Motions
Fangzhou Hong, Vladimir Guzov, Hyo Jin Kim +4
The Replica Dataset: A Digital Replica of Indoor Spaces
Julian Straub, Thomas Whelan, Lingni Ma +27
EFM3D: A Benchmark for Measuring Progress Towards 3D Egocentric Foundation Models
Julian Straub, Daniel DeTone, Tianwei Shen +3
Ego4D: Around the World in 3,000 Hours of Egocentric Video
Kristen Grauman, Andrew Westbury, Eugene Byrne +82
HMD^2: Environment-aware Motion Generation from Single Egocentric Head-Mounted Device
Vladimir Guzov, Yifeng Jiang, Fangzhou Hong +5
Human-in-the-Loop Local Corrections of 3D Scene Layouts via Infilling
Christopher Xie, Armen Avetisyan, Henry Howard-Jenkins +5
Deep Local Shapes: Learning Local SDF Priors for Detailed 3D Reconstruction
Rohan Chabra, Jan Eric Lenssen, Eddy Ilg +4
EgoVerse: An Egocentric Human Dataset for Robot Learning from Around the World
Ryan Punamiya, Simar Kareer, Zeyi Liu +37
ShapeR: Robust Conditional 3D Shape Generation from Casual Captures
Yawar Siddiqui, Duncan Frost, Samir Aroudj +9
Imaging for All-Day Wearable Smart Glasses
Michael Goesele, Daniel Andersen, Yujia Chen +7
OrienterNet: Visual Localization in 2D Public Maps with Neural Matching
Paul-Edouard Sarlin, Daniel DeTone, Tsun-Yi Yang +7
Neural 3D Video Synthesis from Multi-view Video
Tianye Li, Mira Slavcheva, Michael Zollhoefer +8
FroDO: From Detections to 3D Objects
Kejie Li, Martin Rünz, Meng Tang +8
Sonata: Self-Supervised Learning of Reliable Point Representations
Xiaoyang Wu, Daniel DeTone, Duncan Frost +7
Photoreal Scene Reconstruction from an Egocentric Device
Zhaoyang Lv, Maurizio Monge, Ka Chen +5
Digital Twin Catalog: A Large-Scale Photorealistic 3D Object Digital Twin Dataset
Zhao Dong, Ka Chen, Zhaoyang Lv +14
Nymeria: A Massive Collection of Multimodal Egocentric Daily Motion in the Wild
Lingni Ma, Yuting Ye, Fangzhou Hong +14
SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model
Armen Avetisyan, Christopher Xie, Henry Howard-Jenkins +11
Aria Digital Twin: A New Benchmark Dataset for Egocentric 3D Machine Perception
Xiaqing Pan, Nicholas Charron, Yongqian Yang +6
LISA: Learning Implicit Shape and Appearance of Hands
Enric Corona, Tomas Hodan, Minh Vo +4
Project Aria: A New Tool for Egocentric Multi-Modal AI Research
Jakob Engel, Kiran Somasundaram, Michael Goesele +71
Surface Light Field Fusion
Jeong Joon Park, Richard Newcombe, Steve Seitz
Breaking the Barriers to True Augmented Reality
Christian Sandor, Martin Fuchs, Alvaro Cassinelli +4
Learnable Wireless Digital Twins: Reconstructing Electromagnetic Field with Neural Representations
Shuaifeng Jiang, Qi Qu, Xiaqing Pan +3
Monocular Online Reconstruction with Enhanced Detail Preservation
Songyin Wu, Zhaoyang Lv, Yufeng Zhu +6
Introducing HOT3D: An Egocentric Dataset for 3D Hand and Object Tracking
Prithviraj Banerjee, Sindi Shkodrani, Pierre Moulon +9
Self-supervised Neural Articulated Shape and Appearance Models
Fangyin Wei, Rohan Chabra, Lingni Ma +6
NymeriaPlus: Enriching Nymeria Dataset with Additional Annotations and Data
Daniel DeTone, Federica Bogo, Eric-Tuan Le +7
HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos
Prithviraj Banerjee, Sindi Shkodrani, Pierre Moulon +11
Full System Architecture Modeling for Wearable Egocentric Contextual AI
Vincent T. Lee, Tanfer Alan, Sung Kim +6
Benchmarking Egocentric Visual-Inertial SLAM at City Scale
Anusha Krishnan, Shaohui Liu, Paul-Edouard Sarlin +6
LIRM: Large Inverse Rendering Model for Progressive Reconstruction of Shape, Materials and View-dependent Radiance Fields
Zhengqin Li, Dilin Wang, Ka Chen +11
ODAM: Object Detection, Association, and Mapping using Posed RGB Video
Kejie Li, Daniel DeTone, Steven Chen +6
JRM: Joint Reconstruction Model for Multiple Objects without Alignment
Qirui Wu, Yawar Siddiqui, Duncan Frost +6
EgoBlur: Responsible Innovation in Aria
Nikhil Raina, Guruprasad Somasundaram, Kang Zheng +12
EgoHumans: An Egocentric 3D Multi-Human Benchmark
Rawal Khirodkar, Aayush Bansal, Lingni Ma +3
Aria Everyday Activities Dataset
Zhaoyang Lv, Nicholas Charron, Pierre Moulon +21
Nerfels: Renderable Neural Codes for Improved Camera Pose Estimation
Gil Avraham, Julian Straub, Tianwei Shen +7
DeepSDF: Learning Continuous Signed Distance Functions for Shape Representation
Jeong Joon Park, Peter Florence, Julian Straub +2
E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control
Qiao Gu, Lingni Ma, Adam W Harley +3
DGS-LRM: Real-Time Deformable 3D Gaussian Reconstruction From Monocular Videos
Chieh Hubert Lin, Zhaoyang Lv, Songyin Wu +11
StereoDRNet: Dilated Residual Stereo Net
Rohan Chabra, Julian Straub, Chris Sweeney +2
ART: Articulated Reconstruction Transformer
Zizhang Li, Cheng Zhang, Zhengqin Li +7
Segment This Thing: Foveated Tokenization for Efficient Point-Prompted Segmentation
Tanner Schmidt, Richard Newcombe
Reading Recognition in the Wild
Charig Yang, Samiul Alam, Shakhrul Iman Siam +12
Boxer: Robust Lifting of Open-World 2D Bounding Boxes to 3D
Daniel DeTone, Tianwei Shen, Fan Zhang +4
Aria Gen 2 Pilot Dataset
Chen Kong, James Fort, Aria Kang +20
4DGT: Learning a 4D Gaussian Transformer Using Real-World Monocular Videos
Zhen Xu, Zhengqin Li, Zhao Dong +3
LAMP: Localization Aware Multi-camera People Tracking in Metric 3D World
Nan Yang, Julian Straub, Fan Zhang +3
SuperMemory-VQA: An Egocentric Visual Question-Answering Benchmark for Long-Horizon Memory
Samiul Alam, Shakhrul Iman Siam, Michael J. Proulx +4