HRP: Human Affordances for Robotic Pre-Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Srirama, Mohan Kumar, Dasari, Sudeep, Bahl, Shikhar, Gupta, Abhinav |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Ingredients for Robotic Diffusion Transformers
par: Dasari, Sudeep, et autres
Publié: (2024)
par: Dasari, Sudeep, et autres
Publié: (2024)
DexWild: Dexterous Human Interactions for In-the-Wild Robot Policies
par: Tao, Tony, et autres
Publié: (2025)
par: Tao, Tony, et autres
Publié: (2025)
Agentic Scene Policies: Unifying Space, Semantics, and Affordances for Robot Action
par: Morin, Sacha, et autres
Publié: (2025)
par: Morin, Sacha, et autres
Publié: (2025)
ViPRA: Video Prediction for Robot Actions
par: Routray, Sandeep, et autres
Publié: (2025)
par: Routray, Sandeep, et autres
Publié: (2025)
GLOVER++: Unleashing the Potential of Affordance Learning from Human Behaviors for Robotic Manipulation
par: Ma, Teli, et autres
Publié: (2025)
par: Ma, Teli, et autres
Publié: (2025)
RoboPCA: Pose-centered Affordance Learning from Human Demonstrations for Robot Manipulation
par: Xiao, Zhanqi, et autres
Publié: (2026)
par: Xiao, Zhanqi, et autres
Publié: (2026)
PreAfford: Universal Affordance-Based Pre-Grasping for Diverse Objects and Environments
par: Ding, Kairui, et autres
Publié: (2024)
par: Ding, Kairui, et autres
Publié: (2024)
AffordanceGrasp-R1:Leveraging Reasoning-Based Affordance Segmentation with Reinforcement Learning for Robotic Grasping
par: Zhou, Dingyi, et autres
Publié: (2026)
par: Zhou, Dingyi, et autres
Publié: (2026)
Learning Precise Affordances from Egocentric Videos for Robotic Manipulation
par: Li, Gen, et autres
Publié: (2024)
par: Li, Gen, et autres
Publié: (2024)
Track2Act: Predicting Point Tracks from Internet Videos enables Generalizable Robot Manipulation
par: Bharadhwaj, Homanga, et autres
Publié: (2024)
par: Bharadhwaj, Homanga, et autres
Publié: (2024)
Mitigating the Human-Robot Domain Discrepancy in Visual Pre-training for Robotic Manipulation
par: Zhou, Jiaming, et autres
Publié: (2024)
par: Zhou, Jiaming, et autres
Publié: (2024)
Pre-Trained Masked Image Model for Mobile Robot Navigation
par: Sharma, Vishnu Dutt, et autres
Publié: (2023)
par: Sharma, Vishnu Dutt, et autres
Publié: (2023)
AffordanceLLM: Grounding Affordance from Vision Language Models
par: Qian, Shengyi, et autres
Publié: (2024)
par: Qian, Shengyi, et autres
Publié: (2024)
RAM: Retrieval-Based Affordance Transfer for Generalizable Zero-Shot Robotic Manipulation
par: Kuang, Yuxuan, et autres
Publié: (2024)
par: Kuang, Yuxuan, et autres
Publié: (2024)
Panoptic-Depth Forecasting
par: Hurtado, Juana Valeria, et autres
Publié: (2024)
par: Hurtado, Juana Valeria, et autres
Publié: (2024)
Robo-ABC: Affordance Generalization Beyond Categories via Semantic Correspondence for Robot Manipulation
par: Ju, Yuanchen, et autres
Publié: (2024)
par: Ju, Yuanchen, et autres
Publié: (2024)
Panoramic Affordance Prediction
par: Zhang, Zixin, et autres
Publié: (2026)
par: Zhang, Zixin, et autres
Publié: (2026)
A Data-Centric Revisit of Pre-Trained Vision Models for Robot Learning
par: Wen, Xin, et autres
Publié: (2025)
par: Wen, Xin, et autres
Publié: (2025)
Vision-Based Autonomous UAV Navigation and Landing for Urban Search and Rescue
par: Mittal, Mayank, et autres
Publié: (2019)
par: Mittal, Mayank, et autres
Publié: (2019)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
par: Wang, Hanqing, et autres
Publié: (2025)
par: Wang, Hanqing, et autres
Publié: (2025)
General Flow as Foundation Affordance for Scalable Robot Learning
par: Yuan, Chengbo, et autres
Publié: (2024)
par: Yuan, Chengbo, et autres
Publié: (2024)
UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation
par: Tang, Yihe, et autres
Publié: (2025)
par: Tang, Yihe, et autres
Publié: (2025)
arg-VU: Affordance Reasoning with Physics-Aware 3D Geometry for Visual Understanding in Robotic Surgery
par: Xiao, Nan, et autres
Publié: (2026)
par: Xiao, Nan, et autres
Publié: (2026)
Learning Appearance and Motion Cues for Panoptic Tracking
par: Hurtado, Juana Valeria, et autres
Publié: (2025)
par: Hurtado, Juana Valeria, et autres
Publié: (2025)
Visual Affordance Prediction: Survey and Reproducibility
par: Apicella, Tommaso, et autres
Publié: (2025)
par: Apicella, Tommaso, et autres
Publié: (2025)
O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic Manipulation
par: Tian, Tongxuan, et autres
Publié: (2025)
par: Tian, Tongxuan, et autres
Publié: (2025)
3D-AffordanceLLM: Harnessing Large Language Models for Open-Vocabulary Affordance Detection in 3D Worlds
par: Chu, Hengshuo, et autres
Publié: (2025)
par: Chu, Hengshuo, et autres
Publié: (2025)
RT-Affordance: Affordances are Versatile Intermediate Representations for Robot Manipulation
par: Nasiriany, Soroush, et autres
Publié: (2024)
par: Nasiriany, Soroush, et autres
Publié: (2024)
RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training
par: Goswami, Raktim Gautam, et autres
Publié: (2024)
par: Goswami, Raktim Gautam, et autres
Publié: (2024)
Generalized Robot 3D Vision-Language Model with Fast Rendering and Pre-Training Vision-Language Alignment
par: Liu, Kangcheng, et autres
Publié: (2023)
par: Liu, Kangcheng, et autres
Publié: (2023)
MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training
par: Yin, Zhenhan, et autres
Publié: (2025)
par: Yin, Zhenhan, et autres
Publié: (2025)
Affordance RAG: Hierarchical Multimodal Retrieval with Affordance-Aware Embodied Memory for Mobile Manipulation
par: Korekata, Ryosuke, et autres
Publié: (2025)
par: Korekata, Ryosuke, et autres
Publié: (2025)
Affordance Agent Harness: Verification-Gated Skill Orchestration
par: Huang, Haojian, et autres
Publié: (2026)
par: Huang, Haojian, et autres
Publié: (2026)
SENSE: Stereo OpEN Vocabulary SEmantic Segmentation
par: Campagnolo, Thomas, et autres
Publié: (2026)
par: Campagnolo, Thomas, et autres
Publié: (2026)
RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics
par: Yuan, Wentao, et autres
Publié: (2024)
par: Yuan, Wentao, et autres
Publié: (2024)
Imagine2touch: Predictive Tactile Sensing for Robotic Manipulation using Efficient Low-Dimensional Signals
par: Ayad, Abdallah, et autres
Publié: (2024)
par: Ayad, Abdallah, et autres
Publié: (2024)
DAP: Diffusion-based Affordance Prediction for Multi-modality Storage
par: Chang, Haonan, et autres
Publié: (2024)
par: Chang, Haonan, et autres
Publié: (2024)
Simultaneous Localization and Affordance Prediction of Tasks from Egocentric Video
par: Chavis, Zachary, et autres
Publié: (2024)
par: Chavis, Zachary, et autres
Publié: (2024)
PseudoTouch: Efficiently Imaging the Surface Feel of Objects for Robotic Manipulation
par: Röfer, Adrian, et autres
Publié: (2024)
par: Röfer, Adrian, et autres
Publié: (2024)
Dynamic Robot-Assisted Surgery with Hierarchical Class-Incremental Semantic Segmentation
par: Hindel, Julia, et autres
Publié: (2025)
par: Hindel, Julia, et autres
Publié: (2025)
Documents similaires
-
The Ingredients for Robotic Diffusion Transformers
par: Dasari, Sudeep, et autres
Publié: (2024) -
DexWild: Dexterous Human Interactions for In-the-Wild Robot Policies
par: Tao, Tony, et autres
Publié: (2025) -
Agentic Scene Policies: Unifying Space, Semantics, and Affordances for Robot Action
par: Morin, Sacha, et autres
Publié: (2025) -
ViPRA: Video Prediction for Robot Actions
par: Routray, Sandeep, et autres
Publié: (2025) -
GLOVER++: Unleashing the Potential of Affordance Learning from Human Behaviors for Robotic Manipulation
par: Ma, Teli, et autres
Publié: (2025)