Learning Humanoid End-Effector Control for Open-Vocabulary Visual Loco-Manipulation
Fuente:
arXiv
Salvato in:
| Autori principali: | Dong, Runpei, Li, Ziyan, He, Xialin, Gupta, Saurabh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ULTRA: Unified Multimodal Control for Autonomous Humanoid Whole-Body Loco-Manipulation
di: He, Xialin, et al.
Pubblicazione: (2026)
di: He, Xialin, et al.
Pubblicazione: (2026)
Future Success Prediction in Open-Vocabulary Object Manipulation Tasks Based on End-Effector Trajectories
di: Kambara, Motonari, et al.
Pubblicazione: (2024)
di: Kambara, Motonari, et al.
Pubblicazione: (2024)
VisualMimic: Visual Humanoid Loco-Manipulation via Motion Tracking and Generation
di: Yin, Shaofeng, et al.
Pubblicazione: (2025)
di: Yin, Shaofeng, et al.
Pubblicazione: (2025)
SUGAR: A Scalable Human-Video-Driven Generalizable Humanoid Loco-Manipulation Learning Framework
di: Wu, Tianshu, et al.
Pubblicazione: (2026)
di: Wu, Tianshu, et al.
Pubblicazione: (2026)
Learning Getting-Up Policies for Real-World Humanoid Robots
di: He, Xialin, et al.
Pubblicazione: (2025)
di: He, Xialin, et al.
Pubblicazione: (2025)
Visual Whole-Body Control for Legged Loco-Manipulation
di: Liu, Minghuan, et al.
Pubblicazione: (2024)
di: Liu, Minghuan, et al.
Pubblicazione: (2024)
Generalizable Humanoid Manipulation with 3D Diffusion Policies
di: Ze, Yanjie, et al.
Pubblicazione: (2024)
di: Ze, Yanjie, et al.
Pubblicazione: (2024)
Leverage Cross-Attention for End-to-End Open-Vocabulary Panoptic Reconstruction
di: Yu, Xuan, et al.
Pubblicazione: (2025)
di: Yu, Xuan, et al.
Pubblicazione: (2025)
Humanoid-VLA: Towards Universal Humanoid Control with Visual Integration
di: Ding, Pengxiang, et al.
Pubblicazione: (2025)
di: Ding, Pengxiang, et al.
Pubblicazione: (2025)
Foundation Feature-Driven Online End-Effector Pose Estimation: A Marker-Free and Learning-Free Approach
di: Wu, Tianshu, et al.
Pubblicazione: (2025)
di: Wu, Tianshu, et al.
Pubblicazione: (2025)
Scene-Graph ViT: End-to-End Open-Vocabulary Visual Relationship Detection
di: Salzmann, Tim, et al.
Pubblicazione: (2024)
di: Salzmann, Tim, et al.
Pubblicazione: (2024)
SoFar: Language-Grounded Orientation Bridges Spatial Reasoning and Object Manipulation
di: Qi, Zekun, et al.
Pubblicazione: (2025)
di: Qi, Zekun, et al.
Pubblicazione: (2025)
ObjectVLA: End-to-End Open-World Object Manipulation Without Demonstration
di: Zhu, Minjie, et al.
Pubblicazione: (2025)
di: Zhu, Minjie, et al.
Pubblicazione: (2025)
Visual Imitation Enables Contextual Humanoid Control
di: Allshire, Arthur, et al.
Pubblicazione: (2025)
di: Allshire, Arthur, et al.
Pubblicazione: (2025)
HomeRobot: Open-Vocabulary Mobile Manipulation
di: Yenamandra, Sriram, et al.
Pubblicazione: (2023)
di: Yenamandra, Sriram, et al.
Pubblicazione: (2023)
Towards Open-World Mobile Manipulation in Homes: Lessons from the Neurips 2023 HomeRobot Open Vocabulary Mobile Manipulation Challenge
di: Yenamandra, Sriram, et al.
Pubblicazione: (2024)
di: Yenamandra, Sriram, et al.
Pubblicazione: (2024)
WholeBodyVLA: Towards Unified Latent VLA for Whole-Body Loco-Manipulation Control
di: Jiang, Haoran, et al.
Pubblicazione: (2025)
di: Jiang, Haoran, et al.
Pubblicazione: (2025)
Open-Vocabulary Mobile Manipulation Based on Double Relaxed Contrastive Learning with Dense Labeling
di: Yashima, Daichi, et al.
Pubblicazione: (2024)
di: Yashima, Daichi, et al.
Pubblicazione: (2024)
Task Success Prediction for Open-Vocabulary Manipulation Based on Multi-Level Aligned Representations
di: Goko, Miyu, et al.
Pubblicazione: (2024)
di: Goko, Miyu, et al.
Pubblicazione: (2024)
SeeGround: See and Ground for Zero-Shot Open-Vocabulary 3D Visual Grounding
di: Li, Rong, et al.
Pubblicazione: (2024)
di: Li, Rong, et al.
Pubblicazione: (2024)
WildLMa: Long Horizon Loco-Manipulation in the Wild
di: Qiu, Ri-Zhao, et al.
Pubblicazione: (2024)
di: Qiu, Ri-Zhao, et al.
Pubblicazione: (2024)
Splat-MOVER: Multi-Stage, Open-Vocabulary Robotic Manipulation via Editable Gaussian Splatting
di: Shorinwa, Ola, et al.
Pubblicazione: (2024)
di: Shorinwa, Ola, et al.
Pubblicazione: (2024)
Visually-grounded Humanoid Agents
di: Ye, Hang, et al.
Pubblicazione: (2026)
di: Ye, Hang, et al.
Pubblicazione: (2026)
Emergent Active Perception and Dexterity of Simulated Humanoids from Visual Reinforcement Learning
di: Luo, Zhengyi, et al.
Pubblicazione: (2025)
di: Luo, Zhengyi, et al.
Pubblicazione: (2025)
HomeRobot Open Vocabulary Mobile Manipulation Challenge 2023 Participant Report (Team KuzHum)
di: Kuzma, Volodymyr, et al.
Pubblicazione: (2024)
di: Kuzma, Volodymyr, et al.
Pubblicazione: (2024)
TrajBooster: Boosting Humanoid Whole-Body Manipulation via Trajectory-Centric Learning
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
OmniH2O: Universal and Dexterous Human-to-Humanoid Whole-Body Teleoperation and Learning
di: He, Tairan, et al.
Pubblicazione: (2024)
di: He, Tairan, et al.
Pubblicazione: (2024)
OpenLex3D: A Tiered Evaluation Benchmark for Open-Vocabulary 3D Scene Representations
di: Kassab, Christina, et al.
Pubblicazione: (2025)
di: Kassab, Christina, et al.
Pubblicazione: (2025)
OV9D: Open-Vocabulary Category-Level 9D Object Pose and Size Estimation
di: Cai, Junhao, et al.
Pubblicazione: (2024)
di: Cai, Junhao, et al.
Pubblicazione: (2024)
Open-Vocabulary Action Localization with Iterative Visual Prompting
di: Wake, Naoki, et al.
Pubblicazione: (2024)
di: Wake, Naoki, et al.
Pubblicazione: (2024)
Object Segmentation from Open-Vocabulary Manipulation Instructions Based on Optimal Transport Polygon Matching with Multimodal Foundation Models
di: Nishimura, Takayuki, et al.
Pubblicazione: (2024)
di: Nishimura, Takayuki, et al.
Pubblicazione: (2024)
AnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents
di: Cui, Jieming, et al.
Pubblicazione: (2024)
di: Cui, Jieming, et al.
Pubblicazione: (2024)
GROVE: A Generalized Reward for Learning Open-Vocabulary Physical Skill
di: Cui, Jieming, et al.
Pubblicazione: (2025)
di: Cui, Jieming, et al.
Pubblicazione: (2025)
Precise Mobile Manipulation of Small Everyday Objects
di: Gupta, Arjun, et al.
Pubblicazione: (2025)
di: Gupta, Arjun, et al.
Pubblicazione: (2025)
Open-Vocabulary Online Semantic Mapping for SLAM
di: Martins, Tomas Berriel, et al.
Pubblicazione: (2024)
di: Martins, Tomas Berriel, et al.
Pubblicazione: (2024)
LOVON: Legged Open-Vocabulary Object Navigator
di: Peng, Daojie, et al.
Pubblicazione: (2025)
di: Peng, Daojie, et al.
Pubblicazione: (2025)
OpenOcc: Open Vocabulary 3D Scene Reconstruction via Occupancy Representation
di: Jiang, Haochen, et al.
Pubblicazione: (2024)
di: Jiang, Haochen, et al.
Pubblicazione: (2024)
OpenESS: Event-based Semantic Scene Understanding with Open Vocabularies
di: Kong, Lingdong, et al.
Pubblicazione: (2024)
di: Kong, Lingdong, et al.
Pubblicazione: (2024)
SEEC: Stable End-Effector Control with Model-Enhanced Residual Learning for Humanoid Loco-Manipulation
di: Jang, Jaehwi, et al.
Pubblicazione: (2025)
di: Jang, Jaehwi, et al.
Pubblicazione: (2025)
Continual Hand-Eye Calibration for Open-world Robotic Manipulation
di: Li, Fazeng, et al.
Pubblicazione: (2026)
di: Li, Fazeng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ULTRA: Unified Multimodal Control for Autonomous Humanoid Whole-Body Loco-Manipulation
di: He, Xialin, et al.
Pubblicazione: (2026) -
Future Success Prediction in Open-Vocabulary Object Manipulation Tasks Based on End-Effector Trajectories
di: Kambara, Motonari, et al.
Pubblicazione: (2024) -
VisualMimic: Visual Humanoid Loco-Manipulation via Motion Tracking and Generation
di: Yin, Shaofeng, et al.
Pubblicazione: (2025) -
SUGAR: A Scalable Human-Video-Driven Generalizable Humanoid Loco-Manipulation Learning Framework
di: Wu, Tianshu, et al.
Pubblicazione: (2026) -
Learning Getting-Up Policies for Real-World Humanoid Robots
di: He, Xialin, et al.
Pubblicazione: (2025)