Being-0: A Humanoid Robotic Agent with Vision-Language Models and Modular Skills
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yuan, Haoqi, Bai, Yu, Fu, Yuhui, Zhou, Bohan, Feng, Yicheng, Xu, Xinrun, Zhan, Yi, Karlsson, Börje F., Lu, Zongqing |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Diverse Bimanual Dexterous Manipulation Skills from Human Demonstrations
par: Zhou, Bohan, et autres
Publié: (2024)
par: Zhou, Bohan, et autres
Publié: (2024)
X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models
par: Li, Boyu, et autres
Publié: (2026)
par: Li, Boyu, et autres
Publié: (2026)
Cross-Embodiment Dexterous Grasping with Reinforcement Learning
par: Yuan, Haoqi, et autres
Publié: (2024)
par: Yuan, Haoqi, et autres
Publié: (2024)
Towards Proprioception-Aware Embodied Planning for Dual-Arm Humanoid Robots
par: Li, Boyu, et autres
Publié: (2025)
par: Li, Boyu, et autres
Publié: (2025)
DemoHLM: From One Demonstration to Generalizable Humanoid Loco-Manipulation
par: Fu, Yuhui, et autres
Publié: (2025)
par: Fu, Yuhui, et autres
Publié: (2025)
Efficient Residual Learning with Mixture-of-Experts for Universal Dexterous Grasping
par: Huang, Ziye, et autres
Publié: (2024)
par: Huang, Ziye, et autres
Publié: (2024)
Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos
par: Luo, Hao, et autres
Publié: (2025)
par: Luo, Hao, et autres
Publié: (2025)
Being-H0.5: Scaling Human-Centric Robot Learning for Cross-Embodiment Generalization
par: Luo, Hao, et autres
Publié: (2026)
par: Luo, Hao, et autres
Publié: (2026)
UniTacHand: Unified Spatio-Tactile Representation for Human to Robotic Hand Skill Transfer
par: Zhang, Chi, et autres
Publié: (2025)
par: Zhang, Chi, et autres
Publié: (2025)
DualTHOR: A Dual-Arm Humanoid Simulation Platform for Contingency-Aware Planning
par: Li, Boyu, et autres
Publié: (2025)
par: Li, Boyu, et autres
Publié: (2025)
EgoActor: Grounding Task Planning into Spatial-aware Egocentric Actions for Humanoid Robots via Visual-Language Models
par: Bai, Yu, et autres
Publié: (2026)
par: Bai, Yu, et autres
Publié: (2026)
MLLM as Retriever: Interactively Learning Multimodal Retrieval for Embodied Agents
par: Yue, Junpeng, et autres
Publié: (2024)
par: Yue, Junpeng, et autres
Publié: (2024)
Being-H0.7: A Latent World-Action Model from Egocentric Videos
par: Luo, Hao, et autres
Publié: (2026)
par: Luo, Hao, et autres
Publié: (2026)
ExoActor: Exocentric Video Generation as Generalizable Interactive Humanoid Control
par: Zhou, Yanghao, et autres
Publié: (2026)
par: Zhou, Yanghao, et autres
Publié: (2026)
Conservative Offline Robot Policy Learning via Posterior-Transition Reweighting
par: Zhang, Wanpeng, et autres
Publié: (2026)
par: Zhang, Wanpeng, et autres
Publié: (2026)
From Experts to a Generalist: Toward General Whole-Body Control for Humanoid Robots
par: Wang, Yuxuan, et autres
Publié: (2025)
par: Wang, Yuxuan, et autres
Publié: (2025)
Spatial-Aware VLA Pretraining through Visual-Physical Alignment from Human Videos
par: Feng, Yicheng, et autres
Publié: (2025)
par: Feng, Yicheng, et autres
Publié: (2025)
DiG-Flow: Discrepancy-Guided Flow Matching for Robust VLA Models
par: Zhang, Wanpeng, et autres
Publié: (2025)
par: Zhang, Wanpeng, et autres
Publié: (2025)
Joint-Aligned Latent Action: Towards Scalable VLA Pretraining in the Wild
par: Luo, Hao, et autres
Publié: (2026)
par: Luo, Hao, et autres
Publié: (2026)
Learning Vision-Driven Reactive Soccer Skills for Humanoid Robots
par: Wang, Yushi, et autres
Publié: (2025)
par: Wang, Yushi, et autres
Publié: (2025)
JAEGER: Dual-Level Humanoid Whole-Body Controller
par: Ding, Ziluo, et autres
Publié: (2025)
par: Ding, Ziluo, et autres
Publié: (2025)
Rethinking Visual-Language-Action Model Scaling: Alignment, Mixture, and Regularization
par: Wang, Ye, et autres
Publié: (2026)
par: Wang, Ye, et autres
Publié: (2026)
RL from Physical Feedback: Aligning Large Motion Models with Humanoid Control
par: Yue, Junpeng, et autres
Publié: (2025)
par: Yue, Junpeng, et autres
Publié: (2025)
Universal Dexterous Functional Grasping via Demonstration-Editing Reinforcement Learning
par: Mao, Chuan, et autres
Publié: (2025)
par: Mao, Chuan, et autres
Publié: (2025)
DemoGrasp: Universal Dexterous Grasping from a Single Demonstration
par: Yuan, Haoqi, et autres
Publié: (2025)
par: Yuan, Haoqi, et autres
Publié: (2025)
Creative Agents: Empowering Agents with Imagination for Creative Tasks
par: Cai, Penglin, et autres
Publié: (2023)
par: Cai, Penglin, et autres
Publié: (2023)
SENTINEL: A Fully End-to-End Language-Action Model for Humanoid Whole Body Control
par: Wang, Yuxuan, et autres
Publié: (2025)
par: Wang, Yuxuan, et autres
Publié: (2025)
Learning Soccer Skills for Humanoid Robots: A Progressive Perception-Action Framework
par: Kong, Jipeng, et autres
Publié: (2026)
par: Kong, Jipeng, et autres
Publié: (2026)
Trinity: A Modular Humanoid Robot AI System
par: Sun, Jingkai, et autres
Publié: (2025)
par: Sun, Jingkai, et autres
Publié: (2025)
MuGen: Multi-Skill Generative Locomotion Controller for Humanoid Robots
par: Feng, Yusen, et autres
Publié: (2026)
par: Feng, Yusen, et autres
Publié: (2026)
Robot Drummer: Learning Rhythmic Skills for Humanoid Drumming
par: Shahid, Asad Ali, et autres
Publié: (2025)
par: Shahid, Asad Ali, et autres
Publié: (2025)
Switch: Learning Agile Skills Switching for Humanoid Robots
par: Lau, Yuen-Fui, et autres
Publié: (2026)
par: Lau, Yuen-Fui, et autres
Publié: (2026)
SMASH: Mastering Scalable Whole-Body Skills for Humanoid Ping-Pong with Egocentric Vision
par: Ren, Junli, et autres
Publié: (2026)
par: Ren, Junli, et autres
Publié: (2026)
A Modular Object Detection System for Humanoid Robots Using YOLO
par: Pottier, Nicolas, et autres
Publié: (2025)
par: Pottier, Nicolas, et autres
Publié: (2025)
Learning Agile Striker Skills for Humanoid Soccer Robots from Noisy Sensory Input
par: Xu, Zifan, et autres
Publié: (2025)
par: Xu, Zifan, et autres
Publié: (2025)
Learning Human-Like Badminton Skills for Humanoid Robots
par: Chen, Yeke, et autres
Publié: (2026)
par: Chen, Yeke, et autres
Publié: (2026)
RANGER: A Monocular Zero-Shot Semantic Navigation Framework through Visual Contextual Adaptation
par: Yu, Ming-Ming, et autres
Publié: (2025)
par: Yu, Ming-Ming, et autres
Publié: (2025)
SWITCH: Benchmarking Modeling and Handling of Tangible Interfaces in Long-horizon Embodied Scenarios
par: Lin, Jieru, et autres
Publié: (2025)
par: Lin, Jieru, et autres
Publié: (2025)
Learning Motion Skills with Adaptive Assistive Curriculum Force in Humanoid Robots
par: Cao, Zhanxiang, et autres
Publié: (2025)
par: Cao, Zhanxiang, et autres
Publié: (2025)
Unmasking the Illusion of Embodied Reasoning in Vision-Language-Action Models
par: Xu, Haiweng, et autres
Publié: (2026)
par: Xu, Haiweng, et autres
Publié: (2026)
Documents similaires
-
Learning Diverse Bimanual Dexterous Manipulation Skills from Human Demonstrations
par: Zhou, Bohan, et autres
Publié: (2024) -
X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models
par: Li, Boyu, et autres
Publié: (2026) -
Cross-Embodiment Dexterous Grasping with Reinforcement Learning
par: Yuan, Haoqi, et autres
Publié: (2024) -
Towards Proprioception-Aware Embodied Planning for Dual-Arm Humanoid Robots
par: Li, Boyu, et autres
Publié: (2025) -
DemoHLM: From One Demonstration to Generalizable Humanoid Loco-Manipulation
par: Fu, Yuhui, et autres
Publié: (2025)