EgoFound3R: End-to-End Egocentric Hand Reconstruction in World Space with Point-Wise Interaction Attributes
cs.CV
Submitted: 2026-10-01
Updated: 2026-10-03
Terminology
Sources
- Geometric Context Transformer for Streaming 3D Reconstruction
- EgoGrasp: World-Space Hand-Object Interaction Estimation from Egocentric Videos
- Hand Visibility Detector: Per-Keypoint Visibility Estimation for Hands
- Causal World Modeling for Robot Control
- Open-AoE: An Open Egocentric Manipulation Dataset and Toolchain for Embodied Learning
- MobileEgo Anywhere: Open Infrastructure for long horizon egocentric data on commodity hardware
- Do as I Do: Dexterous Manipulation Data from Everyday Human Videos
- EgoInfinity: A Web-Scale 4D Hand-Object Interaction Data Engine for Any-View Robot Retargeting and Video-to-Action Robot Learning
- From Foundation to Application: Improving VLA Models in Practice
- World Action Models are Zero-shot Policies
- StableHand: Quality-Aware Flow Matching for World-Space Dual-Hand Motion Estimation from Egocentric Video
- EgoScale: Scaling Dexterous Manipulation with Diverse Egocentric Human Data
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models