NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (52)

cs.CV2024

Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives

Kristen Grauman, Andrew Westbury, Lorenzo Torresani +98

cs.CV2022

ERF: Explicit Radiance Field Reconstruction From Scratch

Samir Aroudj, Steven Lovegrove, Eddy Ilg +3

cs.CV2024

EgoLM: Multi-Modal Language Model of Egocentric Motions

Fangzhou Hong, Vladimir Guzov, Hyo Jin Kim +4

cs.CV2019

The Replica Dataset: A Digital Replica of Indoor Spaces

Julian Straub, Thomas Whelan, Lingni Ma +27

cs.CV2024

EFM3D: A Benchmark for Measuring Progress Towards 3D Egocentric Foundation Models

Julian Straub, Daniel DeTone, Tianwei Shen +3

cs.CV2022

Ego4D: Around the World in 3,000 Hours of Egocentric Video

Kristen Grauman, Andrew Westbury, Eugene Byrne +82

cs.CV2025

HMD^2: Environment-aware Motion Generation from Single Egocentric Head-Mounted Device

Vladimir Guzov, Yifeng Jiang, Fangzhou Hong +5

cs.CV2025

Human-in-the-Loop Local Corrections of 3D Scene Layouts via Infilling

Christopher Xie, Armen Avetisyan, Henry Howard-Jenkins +5

cs.CV2020

Deep Local Shapes: Learning Local SDF Priors for Detailed 3D Reconstruction

Rohan Chabra, Jan Eric Lenssen, Eddy Ilg +4

cs.RO2026

EgoVerse: An Egocentric Human Dataset for Robot Learning from Around the World

Ryan Punamiya, Simar Kareer, Zeyi Liu +37

cs.CV2026

ShapeR: Robust Conditional 3D Shape Generation from Casual Captures

Yawar Siddiqui, Duncan Frost, Samir Aroudj +9

cs.CV2025

Imaging for All-Day Wearable Smart Glasses

Michael Goesele, Daniel Andersen, Yujia Chen +7

cs.CV2023

OrienterNet: Visual Localization in 2D Public Maps with Neural Matching

Paul-Edouard Sarlin, Daniel DeTone, Tsun-Yi Yang +7

cs.CV2022

Neural 3D Video Synthesis from Multi-view Video

Tianye Li, Mira Slavcheva, Michael Zollhoefer +8

cs.CV2020

FroDO: From Detections to 3D Objects

Kejie Li, Martin Rünz, Meng Tang +8

cs.CV2025

Sonata: Self-Supervised Learning of Reliable Point Representations

Xiaoyang Wu, Daniel DeTone, Duncan Frost +7

cs.CV2025

Photoreal Scene Reconstruction from an Egocentric Device

Zhaoyang Lv, Maurizio Monge, Ka Chen +5

cs.GR2025

Digital Twin Catalog: A Large-Scale Photorealistic 3D Object Digital Twin Dataset

Zhao Dong, Ka Chen, Zhaoyang Lv +14

cs.CV2024

Nymeria: A Massive Collection of Multimodal Egocentric Daily Motion in the Wild

Lingni Ma, Yuting Ye, Fangzhou Hong +14

cs.CV2024

SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model

Armen Avetisyan, Christopher Xie, Henry Howard-Jenkins +11

cs.CV2023

Aria Digital Twin: A New Benchmark Dataset for Egocentric 3D Machine Perception

Xiaqing Pan, Nicholas Charron, Yongqian Yang +6

cs.CV2022

LISA: Learning Implicit Shape and Appearance of Hands

Enric Corona, Tomas Hodan, Minh Vo +4

cs.HC2023

Project Aria: A New Tool for Egocentric Multi-Modal AI Research

Jakob Engel, Kiran Somasundaram, Michael Goesele +71

cs.CV2018

Surface Light Field Fusion

Jeong Joon Park, Richard Newcombe, Steve Seitz

cs.HC2015

Breaking the Barriers to True Augmented Reality

Christian Sandor, Martin Fuchs, Alvaro Cassinelli +4

cs.IT2024

Learnable Wireless Digital Twins: Reconstructing Electromagnetic Field with Neural Representations

Shuaifeng Jiang, Qi Qu, Xiaqing Pan +3

cs.GR2025

Monocular Online Reconstruction with Enhanced Detail Preservation

Songyin Wu, Zhaoyang Lv, Yufeng Zhu +6

cs.CV2024

Introducing HOT3D: An Egocentric Dataset for 3D Hand and Object Tracking

Prithviraj Banerjee, Sindi Shkodrani, Pierre Moulon +9

cs.CV2022

Self-supervised Neural Articulated Shape and Appearance Models

Fangyin Wei, Rohan Chabra, Lingni Ma +6

cs.CV2026

NymeriaPlus: Enriching Nymeria Dataset with Additional Annotations and Data

Daniel DeTone, Federica Bogo, Eric-Tuan Le +7

cs.CV2025

HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos

Prithviraj Banerjee, Sindi Shkodrani, Pierre Moulon +11

cs.AR2025

Full System Architecture Modeling for Wearable Egocentric Contextual AI

Vincent T. Lee, Tanfer Alan, Sung Kim +6

cs.CV2025

Benchmarking Egocentric Visual-Inertial SLAM at City Scale

Anusha Krishnan, Shaohui Liu, Paul-Edouard Sarlin +6

cs.CV2025

LIRM: Large Inverse Rendering Model for Progressive Reconstruction of Shape, Materials and View-dependent Radiance Fields

Zhengqin Li, Dilin Wang, Ka Chen +11

cs.CV2021

ODAM: Object Detection, Association, and Mapping using Posed RGB Video

Kejie Li, Daniel DeTone, Steven Chen +6

cs.CV2026

JRM: Joint Reconstruction Model for Multiple Objects without Alignment

Qirui Wu, Yawar Siddiqui, Duncan Frost +6

cs.CV2023

EgoBlur: Responsible Innovation in Aria

Nikhil Raina, Guruprasad Somasundaram, Kang Zheng +12

cs.CV2023

EgoHumans: An Egocentric 3D Multi-Human Benchmark

Rawal Khirodkar, Aayush Bansal, Lingni Ma +3

cs.CV2024

Aria Everyday Activities Dataset

Zhaoyang Lv, Nicholas Charron, Pierre Moulon +21

cs.CV2022

Nerfels: Renderable Neural Codes for Improved Camera Pose Estimation

Gil Avraham, Julian Straub, Tianwei Shen +7

cs.CV2019

DeepSDF: Learning Continuous Signed Distance Functions for Shape Representation

Jeong Joon Park, Peter Florence, Julian Straub +2

cs.CV2026

E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control

Qiao Gu, Lingni Ma, Adam W Harley +3

cs.GR2025

DGS-LRM: Real-Time Deformable 3D Gaussian Reconstruction From Monocular Videos

Chieh Hubert Lin, Zhaoyang Lv, Songyin Wu +11

cs.CV2019

StereoDRNet: Dilated Residual Stereo Net

Rohan Chabra, Julian Straub, Chris Sweeney +2

cs.CV2026

ART: Articulated Reconstruction Transformer

Zizhang Li, Cheng Zhang, Zhengqin Li +7

cs.CV2025

Segment This Thing: Foveated Tokenization for Efficient Point-Prompted Segmentation

Tanner Schmidt, Richard Newcombe

cs.CV2026

Reading Recognition in the Wild

Charig Yang, Samiul Alam, Shakhrul Iman Siam +12

cs.CV2026

Boxer: Robust Lifting of Open-World 2D Bounding Boxes to 3D

Daniel DeTone, Tianwei Shen, Fan Zhang +4

cs.CV2025

Aria Gen 2 Pilot Dataset

Chen Kong, James Fort, Aria Kang +20

cs.CV2025

4DGT: Learning a 4D Gaussian Transformer Using Real-World Monocular Videos

Zhen Xu, Zhengqin Li, Zhao Dong +3

cs.CV2026

LAMP: Localization Aware Multi-camera People Tracking in Metric 3D World

Nan Yang, Julian Straub, Fan Zhang +3

cs.CV2026

SuperMemory-VQA: An Egocentric Visual Question-Answering Benchmark for Long-Horizon Memory

Samiul Alam, Shakhrul Iman Siam, Michael J. Proulx +4