HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Zhi, He, Botao, Yu, Kelin, Lee, Seungjae, Gao, Ruohan, Huang, Furong, Aloimonos, Yiannis |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dream to Fly: Model-Based Reinforcement Learning for Vision-Based Drone Flight
par: Romero, Angel, et autres
Publié: (2025)
par: Romero, Angel, et autres
Publié: (2025)
WayFASTER: a Self-Supervised Traversability Prediction for Increased Navigation Awareness
par: Gasparino, Mateus Valverde, et autres
Publié: (2024)
par: Gasparino, Mateus Valverde, et autres
Publié: (2024)
Learning from Watching: Scalable Extraction of Manipulation Trajectories from Human Videos
par: Hu, X., et autres
Publié: (2025)
par: Hu, X., et autres
Publié: (2025)
CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
par: Römer, Ralf, et autres
Publié: (2026)
par: Römer, Ralf, et autres
Publié: (2026)
Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
par: Aida, Adriana, et autres
Publié: (2026)
par: Aida, Adriana, et autres
Publié: (2026)
ExpReS-VLA: Specializing Vision-Language-Action Models Through Experience Replay and Retrieval
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
Curb Your Attention: Causal Attention Gating for Robust Trajectory Prediction in Autonomous Driving
par: Ahmadi, Ehsan, et autres
Publié: (2024)
par: Ahmadi, Ehsan, et autres
Publié: (2024)
Towards Cognitive Collaborative Robots: Semantic-Level Integration and Explainable Control for Human-Centric Cooperation
par: Oh, Jaehong
Publié: (2025)
par: Oh, Jaehong
Publié: (2025)
From Demonstrations to Safe Deployment: Path-Consistent Safety Filtering for Diffusion Policies
par: Römer, Ralf, et autres
Publié: (2025)
par: Römer, Ralf, et autres
Publié: (2025)
Failure Prediction at Runtime for Generative Robot Policies
par: Römer, Ralf, et autres
Publié: (2025)
par: Römer, Ralf, et autres
Publié: (2025)
EmbodiedLGR: Integrating Lightweight Graph Representation and Retrieval for Semantic-Spatial Memory in Robotic Agents
par: Riva, Paolo, et autres
Publié: (2026)
par: Riva, Paolo, et autres
Publié: (2026)
Motion Perceiver: Real-Time Occupancy Forecasting for Embedded Systems
par: Ferenczi, Bryce, et autres
Publié: (2023)
par: Ferenczi, Bryce, et autres
Publié: (2023)
RoboPack: Learning Tactile-Informed Dynamics Models for Dense Packing
par: Ai, Bo, et autres
Publié: (2024)
par: Ai, Bo, et autres
Publié: (2024)
Vision-based Situational Graphs Exploiting Fiducial Markers for the Integration of Semantic Entities
par: Tourani, Ali, et autres
Publié: (2023)
par: Tourani, Ali, et autres
Publié: (2023)
UAV-assisted Visual SLAM Generating Reconstructed 3D Scene Graphs in GPS-denied Environments
par: Radwan, Ahmed, et autres
Publié: (2024)
par: Radwan, Ahmed, et autres
Publié: (2024)
A Segmented Robot Grasping Perception Neural Network for Edge AI
par: Bröcheler, Casper, et autres
Publié: (2025)
par: Bröcheler, Casper, et autres
Publié: (2025)
Selective Progress-Aware Querying for Human-in-the-Loop Reinforcement Learning
par: Muraleedharan, Anujith, et autres
Publié: (2025)
par: Muraleedharan, Anujith, et autres
Publié: (2025)
OpenMap: Instruction Grounding via Open-Vocabulary Visual-Language Mapping
par: Li, Danyang, et autres
Publié: (2025)
par: Li, Danyang, et autres
Publié: (2025)
Taking Flight with Dialogue: Enabling Natural Language Control for PX4-based Drone Agent
par: Lim, Shoon Kit, et autres
Publié: (2025)
par: Lim, Shoon Kit, et autres
Publié: (2025)
StratXplore: Strategic Novelty-seeking and Instruction-aligned Exploration for Vision and Language Navigation
par: Gopinathan, Muraleekrishna, et autres
Publié: (2024)
par: Gopinathan, Muraleekrishna, et autres
Publié: (2024)
Deep Probabilistic Traversability with Test-time Adaptation for Uncertainty-aware Planetary Rover Navigation
par: Endo, Masafumi, et autres
Publié: (2024)
par: Endo, Masafumi, et autres
Publié: (2024)
CoMoCAVs: Cohesive Decision-Guided Motion Planning for Connected and Autonomous Vehicles with Multi-Policy Reinforcement Learning
par: Hu, Pan
Publié: (2025)
par: Hu, Pan
Publié: (2025)
Closed-Loop Neural Activation Control in Vision-Language-Action Models
par: Babu, Abhijith, et autres
Publié: (2026)
par: Babu, Abhijith, et autres
Publié: (2026)
Unpacking Failure Modes of Generative Policies: Runtime Monitoring of Consistency and Progress
par: Agia, Christopher, et autres
Publié: (2024)
par: Agia, Christopher, et autres
Publié: (2024)
Preventing Robotic Jailbreaking via Multimodal Domain Adaptation
par: Marchiori, Francesco, et autres
Publié: (2025)
par: Marchiori, Francesco, et autres
Publié: (2025)
Industrial Robot Motion Planning with GPUs: Integration of cuRobo for Extended DOF Systems
par: Abuelsamen, Luai, et autres
Publié: (2025)
par: Abuelsamen, Luai, et autres
Publié: (2025)
Deployment-Time Reliability of Learned Robot Policies
par: Agia, Christopher
Publié: (2026)
par: Agia, Christopher
Publié: (2026)
DRAE: Dynamic Retrieval-Augmented Expert Networks for Lifelong Learning and Task Adaptation in Robotics
par: Long, Yayu, et autres
Publié: (2025)
par: Long, Yayu, et autres
Publié: (2025)
Zero-Shot Object Goal Visual Navigation With Class-Independent Relationship Network
par: Li, Xinting, et autres
Publié: (2023)
par: Li, Xinting, et autres
Publié: (2023)
Magnet-Based Soft Robotic Skin Using a 3D-Printed Multi-Lattice Structure and CNN-Based Tactile Super-Resolution
par: Bang, Yunseong, et autres
Publié: (2026)
par: Bang, Yunseong, et autres
Publié: (2026)
VITA: Zero-Shot Value Functions via Test-Time Adaptation of Vision-Language Models
par: Ziakas, Christos, et autres
Publié: (2025)
par: Ziakas, Christos, et autres
Publié: (2025)
Tactile-Proprioceptive Sensor Fusion for Contact Wrench Estimation in Whole-Body Physical Human-Robot Interaction
par: Min, Junha, et autres
Publié: (2026)
par: Min, Junha, et autres
Publié: (2026)
Pointing-Guided Target Estimation via Transformer-Based Attention
par: Müller, Luca, et autres
Publié: (2025)
par: Müller, Luca, et autres
Publié: (2025)
NeuGrasp: Generalizable Neural Surface Reconstruction with Background Priors for Material-Agnostic Object Grasp Detection
par: Fan, Qingyu, et autres
Publié: (2025)
par: Fan, Qingyu, et autres
Publié: (2025)
eStonefish-Scenes: A Sim-to-Real Validated and Robot-Centric Event-based Optical Flow Dataset for Underwater Vehicles
par: Mansour, Jad, et autres
Publié: (2025)
par: Mansour, Jad, et autres
Publié: (2025)
CaMeRL: Collision-Aware and Memory-Enhanced Reinforcement Learning for UAV Navigation in Multi-Scale Obstacle Environments
par: Hong, Hong, et autres
Publié: (2026)
par: Hong, Hong, et autres
Publié: (2026)
Affordance-Aware Interactive Decision-Making and Execution for Ambiguous Instructions
par: Xu, Hengxuan, et autres
Publié: (2026)
par: Xu, Hengxuan, et autres
Publié: (2026)
ScoRe-Flow: Complete Distributional Control via Score-Based Reinforcement Learning for Flow Matching
par: Qiu, Xiaotian, et autres
Publié: (2026)
par: Qiu, Xiaotian, et autres
Publié: (2026)
CrossVLA: Cross-Paradigm Post-Training and Inference Optimization for Vision-Language-Action Models
par: Liu, Zhi
Publié: (2026)
par: Liu, Zhi
Publié: (2026)
OWMM-Agent: Open World Mobile Manipulation With Multi-modal Agentic Data Synthesis
par: Chen, Junting, et autres
Publié: (2025)
par: Chen, Junting, et autres
Publié: (2025)
Documents similaires
-
Dream to Fly: Model-Based Reinforcement Learning for Vision-Based Drone Flight
par: Romero, Angel, et autres
Publié: (2025) -
WayFASTER: a Self-Supervised Traversability Prediction for Increased Navigation Awareness
par: Gasparino, Mateus Valverde, et autres
Publié: (2024) -
Learning from Watching: Scalable Extraction of Manipulation Trajectories from Human Videos
par: Hu, X., et autres
Publié: (2025) -
CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
par: Römer, Ralf, et autres
Publié: (2026) -
Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
par: Aida, Adriana, et autres
Publié: (2026)