RoSHI: A Versatile Robot-oriented Suit for Human Data In-the-Wild
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mao, Wenjing Margaret, Ng, Jefferson, Hu, Luyang, Gehrig, Daniel, Loquercio, Antonio |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
End-to-End Navigation with Vision Language Models: Transforming Spatial Reasoning into Question-Answering
par: Goetting, Dylan, et autres
Publié: (2024)
par: Goetting, Dylan, et autres
Publié: (2024)
EgoPet: Egomotion and Interaction Data from an Animal's Perspective
par: Bar, Amir, et autres
Publié: (2024)
par: Bar, Amir, et autres
Publié: (2024)
Reinforcement Learning Meets Visual Odometry
par: Messikommer, Nico, et autres
Publié: (2024)
par: Messikommer, Nico, et autres
Publié: (2024)
EqNIO: Subequivariant Neural Inertial Odometry
par: Jayanth, Royina Karegoudra, et autres
Publié: (2024)
par: Jayanth, Royina Karegoudra, et autres
Publié: (2024)
DROID-SLAM in the Wild
par: Li, Moyang, et autres
Publié: (2026)
par: Li, Moyang, et autres
Publié: (2026)
VidBot: Learning Generalizable 3D Actions from In-the-Wild 2D Human Videos for Zero-Shot Robotic Manipulation
par: Chen, Hanzhi, et autres
Publié: (2025)
par: Chen, Hanzhi, et autres
Publié: (2025)
RoMu4o: A Robotic Manipulation Unit For Orchard Operations Automating Proximal Hyperspectral Leaf Sensing
par: Mortazavi, Mehrad, et autres
Publié: (2025)
par: Mortazavi, Mehrad, et autres
Publié: (2025)
ETAP: Event-based Tracking of Any Point
par: Hamann, Friedhelm, et autres
Publié: (2024)
par: Hamann, Friedhelm, et autres
Publié: (2024)
DexWild: Dexterous Human Interactions for In-the-Wild Robot Policies
par: Tao, Tony, et autres
Publié: (2025)
par: Tao, Tony, et autres
Publié: (2025)
GSWorld: Closed-Loop Photo-Realistic Simulation Suite for Robotic Manipulation
par: Jiang, Guangqi, et autres
Publié: (2025)
par: Jiang, Guangqi, et autres
Publié: (2025)
RoCoDA: Counterfactual Data Augmentation for Data-Efficient Robot Learning from Demonstrations
par: Ameperosa, Ezra, et autres
Publié: (2024)
par: Ameperosa, Ezra, et autres
Publié: (2024)
WildOS: Open-Vocabulary Object Search in the Wild
par: Shah, Hardik, et autres
Publié: (2026)
par: Shah, Hardik, et autres
Publié: (2026)
Hand-Object Interaction Pretraining from Videos
par: Singh, Himanshu Gaurav, et autres
Publié: (2024)
par: Singh, Himanshu Gaurav, et autres
Publié: (2024)
RoBridge: A Hierarchical Architecture Bridging Cognition and Execution for General Robotic Manipulation
par: Zhang, Kaidong, et autres
Publié: (2025)
par: Zhang, Kaidong, et autres
Publié: (2025)
OCRA: Object-Centric Learning with 3D and Tactile Priors for Human-to-Robot Action Transfer
par: Wang, Kuanning, et autres
Publié: (2026)
par: Wang, Kuanning, et autres
Publié: (2026)
Ponimator: Unfolding Interactive Pose for Versatile Human-human Interaction Animation
par: Liu, Shaowei, et autres
Publié: (2025)
par: Liu, Shaowei, et autres
Publié: (2025)
HRIBench: Benchmarking Vision-Language Models for Real-Time Human Perception in Human-Robot Interaction
par: Shi, Zhonghao, et autres
Publié: (2025)
par: Shi, Zhonghao, et autres
Publié: (2025)
RoEL: Robust Event-based 3D Line Reconstruction
par: Bae, Gwangtak, et autres
Publié: (2026)
par: Bae, Gwangtak, et autres
Publié: (2026)
LLM-Grounded Dynamic Task Planning with Hierarchical Temporal Logic for Human-Aware Multi-Robot Collaboration
par: Hu, Shuyuan, et autres
Publié: (2026)
par: Hu, Shuyuan, et autres
Publié: (2026)
Mitigating the Human-Robot Domain Discrepancy in Visual Pre-training for Robotic Manipulation
par: Zhou, Jiaming, et autres
Publié: (2024)
par: Zhou, Jiaming, et autres
Publié: (2024)
Articulated Object Estimation in the Wild
par: Werby, Abdelrhman, et autres
Publié: (2025)
par: Werby, Abdelrhman, et autres
Publié: (2025)
Multimodal Anomaly Detection for Human-Robot Interaction
par: Ribeiro, Guilherme, et autres
Publié: (2026)
par: Ribeiro, Guilherme, et autres
Publié: (2026)
HRP: Human Affordances for Robotic Pre-Training
par: Srirama, Mohan Kumar, et autres
Publié: (2024)
par: Srirama, Mohan Kumar, et autres
Publié: (2024)
MINT-RVAE: Multi-Cues Intention Prediction of Human-Robot Interaction using Human Pose and Emotion Information from RGB-only Camera Data
par: Mohsen, Farida, et autres
Publié: (2025)
par: Mohsen, Farida, et autres
Publié: (2025)
Multi-Camera Hand-Eye Calibration for Human-Robot Collaboration in Industrial Robotic Workcells
par: Allegro, Davide, et autres
Publié: (2024)
par: Allegro, Davide, et autres
Publié: (2024)
ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations
par: Zeng, Qiyuan, et autres
Publié: (2025)
par: Zeng, Qiyuan, et autres
Publié: (2025)
Integrating Persian Lip Reading in Surena-V Humanoid Robot for Human-Robot Interaction
par: Abbasi, Ali Farshian, et autres
Publié: (2025)
par: Abbasi, Ali Farshian, et autres
Publié: (2025)
Robot Learning from Human Videos: A Survey
par: Ma, Junyi, et autres
Publié: (2026)
par: Ma, Junyi, et autres
Publié: (2026)
Stereo Hand-Object Reconstruction for Human-to-Robot Handover
par: Pang, Yik Lung, et autres
Publié: (2024)
par: Pang, Yik Lung, et autres
Publié: (2024)
Robotic-CLIP: Fine-tuning CLIP on Action Data for Robotic Applications
par: Nguyen, Nghia, et autres
Publié: (2024)
par: Nguyen, Nghia, et autres
Publié: (2024)
UPTor: Unified 3D Human Pose Dynamics and Trajectory Prediction for Human-Robot Interaction
par: Nilavadi, Nisarga, et autres
Publié: (2025)
par: Nilavadi, Nisarga, et autres
Publié: (2025)
PointWorld: Scaling 3D World Models for In-The-Wild Robotic Manipulation
par: Huang, Wenlong, et autres
Publié: (2026)
par: Huang, Wenlong, et autres
Publié: (2026)
OmniRobotHome: A Multi-Camera Platform for Real-Time Multiadic Human-Robot Interaction
par: Lee, Junyoung, et autres
Publié: (2026)
par: Lee, Junyoung, et autres
Publié: (2026)
Cross-modal State Space Modeling for Real-time RGB-thermal Wild Scene Semantic Segmentation
par: Guo, Xiaodong, et autres
Publié: (2025)
par: Guo, Xiaodong, et autres
Publié: (2025)
Caltech Aerial RGB-Thermal Dataset in the Wild
par: Lee, Connor, et autres
Publié: (2024)
par: Lee, Connor, et autres
Publié: (2024)
TrackVLA: Embodied Visual Tracking in the Wild
par: Wang, Shaoan, et autres
Publié: (2025)
par: Wang, Shaoan, et autres
Publié: (2025)
Vision-Based Safe Human-Robot Collaboration with Uncertainty Guarantees
par: Thumm, Jakob, et autres
Publié: (2026)
par: Thumm, Jakob, et autres
Publié: (2026)
Evaluating Pointing Gestures for Target Selection in Human-Robot Collaboration
par: Sassali, Noora, et autres
Publié: (2025)
par: Sassali, Noora, et autres
Publié: (2025)
From Generated Human Videos to Physically Plausible Robot Trajectories
par: Ni, James, et autres
Publié: (2025)
par: Ni, James, et autres
Publié: (2025)
Breathless: An 8-hour Performance Contrasting Human and Robot Expressiveness
par: Cuan, Catie, et autres
Publié: (2024)
par: Cuan, Catie, et autres
Publié: (2024)
Documents similaires
-
End-to-End Navigation with Vision Language Models: Transforming Spatial Reasoning into Question-Answering
par: Goetting, Dylan, et autres
Publié: (2024) -
EgoPet: Egomotion and Interaction Data from an Animal's Perspective
par: Bar, Amir, et autres
Publié: (2024) -
Reinforcement Learning Meets Visual Odometry
par: Messikommer, Nico, et autres
Publié: (2024) -
EqNIO: Subequivariant Neural Inertial Odometry
par: Jayanth, Royina Karegoudra, et autres
Publié: (2024) -
DROID-SLAM in the Wild
par: Li, Moyang, et autres
Publié: (2026)