Humanoid Agent via Embodied Chain-of-Action Reasoning with Multimodal Foundation Models for Zero-Shot Loco-Manipulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wen, Congcong, Bethala, Geeta Chandra Raju, Hao, Yu, Pudasaini, Niraj, Huang, Hao, Yuan, Shuaihang, Huang, Baoru, Nguyen, Anh, Wang, Mengyu, Tzes, Anthony, Fang, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
H2-COMPACT: Human-Humanoid Co-Manipulation via Adaptive Contact Trajectory Policies
par: Bethala, Geeta Chandra Raju, et autres
Publié: (2025)
par: Bethala, Geeta Chandra Raju, et autres
Publié: (2025)
One-shot Adaptation of Humanoid Whole-body Motion with Walking Priors
par: Huang, Hao, et autres
Publié: (2025)
par: Huang, Hao, et autres
Publié: (2025)
Wavelet Policy: Lifting Scheme for Policy Learning in Long-Horizon Tasks
par: Huang, Hao, et autres
Publié: (2025)
par: Huang, Hao, et autres
Publié: (2025)
MapBERT: Bitwise Masked Modeling for Real-Time Semantic Mapping Generation
par: Deng, Yijie, et autres
Publié: (2025)
par: Deng, Yijie, et autres
Publié: (2025)
How Secure Are Large Language Models (LLMs) for Navigation in Urban Environments?
par: Wen, Congcong, et autres
Publié: (2024)
par: Wen, Congcong, et autres
Publié: (2024)
Socially-Aware Robot Navigation Enhanced by Bidirectional Natural Language Conversations Using Large Language Models
par: Wen, Congcong, et autres
Publié: (2024)
par: Wen, Congcong, et autres
Publié: (2024)
Exploring the Reliability of Foundation Model-Based Frontier Selection in Zero-Shot Object Goal Navigation
par: Yuan, Shuaihang, et autres
Publié: (2024)
par: Yuan, Shuaihang, et autres
Publié: (2024)
GAMap: Zero-Shot Object Goal Navigation with Multi-Scale Geometric-Affordance Guidance
par: Yuan, Shuaihang, et autres
Publié: (2024)
par: Yuan, Shuaihang, et autres
Publié: (2024)
Hierarchical Scoring with 3D Gaussian Splatting for Instance Image-Goal Navigation
par: Deng, Yijie, et autres
Publié: (2025)
par: Deng, Yijie, et autres
Publié: (2025)
Reliable Semantic Understanding for Real World Zero-shot Object Goal Navigation
par: Unlu, Halil Utku, et autres
Publié: (2024)
par: Unlu, Halil Utku, et autres
Publié: (2024)
Integrating Retrospective Framework in Multi-Robot Collaboration
par: Liang, Jiazhao, et autres
Publié: (2025)
par: Liang, Jiazhao, et autres
Publié: (2025)
AudioScene: Integrating Object-Event Audio into 3D Scenes
par: Yuan, Shuaihang, et autres
Publié: (2025)
par: Yuan, Shuaihang, et autres
Publié: (2025)
A Chain-of-Thought Subspace Meta-Learning for Few-shot Image Captioning with Large Vision and Language Models
par: Huang, Hao, et autres
Publié: (2025)
par: Huang, Hao, et autres
Publié: (2025)
FAME: Force-Adaptive RL for Expanding the Manipulation Envelope of a Full-Scale Humanoid
par: Pudasaini, Niraj, et autres
Publié: (2026)
par: Pudasaini, Niraj, et autres
Publié: (2026)
$Ψ_0$: An Open Foundation Model Towards Universal Humanoid Loco-Manipulation
par: Wei, Songlin, et autres
Publié: (2026)
par: Wei, Songlin, et autres
Publié: (2026)
Zero-shot Object Navigation with Vision-Language Models Reasoning
par: Wen, Congcong, et autres
Publié: (2024)
par: Wen, Congcong, et autres
Publié: (2024)
ULTRA: Unified Multimodal Control for Autonomous Humanoid Whole-Body Loco-Manipulation
par: He, Xialin, et autres
Publié: (2026)
par: He, Xialin, et autres
Publié: (2026)
HOMIE: Humanoid Loco-Manipulation with Isomorphic Exoskeleton Cockpit
par: Ben, Qingwei, et autres
Publié: (2025)
par: Ben, Qingwei, et autres
Publié: (2025)
Humanoid Loco-Manipulations Pattern Generation and Stabilization Control
par: Murooka, Masaki, et autres
Publié: (2025)
par: Murooka, Masaki, et autres
Publié: (2025)
FALCON: Learning Force-Adaptive Humanoid Loco-Manipulation
par: Zhang, Yuanhang, et autres
Publié: (2025)
par: Zhang, Yuanhang, et autres
Publié: (2025)
EgoHumanoid: Unlocking In-the-Wild Loco-Manipulation with Robot-Free Egocentric Demonstration
par: Shi, Modi, et autres
Publié: (2026)
par: Shi, Modi, et autres
Publié: (2026)
SUGAR: A Scalable Human-Video-Driven Generalizable Humanoid Loco-Manipulation Learning Framework
par: Wu, Tianshu, et autres
Publié: (2026)
par: Wu, Tianshu, et autres
Publié: (2026)
VIRAL: Visual Sim-to-Real at Scale for Humanoid Loco-Manipulation
par: He, Tairan, et autres
Publié: (2025)
par: He, Tairan, et autres
Publié: (2025)
AGILE: A Comprehensive Workflow for Humanoid Loco-Manipulation Learning
par: Zhao, Huihua, et autres
Publié: (2026)
par: Zhao, Huihua, et autres
Publié: (2026)
Egocentric Tactile and Proximity Sensors as Observation Priors for Humanoid Collision Avoidance
par: Kohlbrenner, Carson, et autres
Publié: (2026)
par: Kohlbrenner, Carson, et autres
Publié: (2026)
Safe Human-to-Humanoid Motion Imitation Using Control Barrier Functions
par: Cai, Wenqi, et autres
Publié: (2026)
par: Cai, Wenqi, et autres
Publié: (2026)
DemoHLM: From One Demonstration to Generalizable Humanoid Loco-Manipulation
par: Fu, Yuhui, et autres
Publié: (2025)
par: Fu, Yuhui, et autres
Publié: (2025)
Physically Consistent Humanoid Loco-Manipulation using Latent Diffusion Models
par: Taouil, Ilyass, et autres
Publié: (2025)
par: Taouil, Ilyass, et autres
Publié: (2025)
ULC: A Unified and Fine-Grained Controller for Humanoid Loco-Manipulation
par: Sun, Wandong, et autres
Publié: (2025)
par: Sun, Wandong, et autres
Publié: (2025)
Meta-Learning 3D Shape Segmentation Functions
par: Hao, Yu, et autres
Publié: (2021)
par: Hao, Yu, et autres
Publié: (2021)
OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction
par: Yang, Lujie, et autres
Publié: (2025)
par: Yang, Lujie, et autres
Publié: (2025)
ToddlerBot: Open-Source ML-Compatible Humanoid Platform for Loco-Manipulation
par: Shi, Haochen, et autres
Publié: (2025)
par: Shi, Haochen, et autres
Publié: (2025)
VisualMimic: Visual Humanoid Loco-Manipulation via Motion Tracking and Generation
par: Yin, Shaofeng, et autres
Publié: (2025)
par: Yin, Shaofeng, et autres
Publié: (2025)
Learning Humanoid End-Effector Control for Open-Vocabulary Visual Loco-Manipulation
par: Dong, Runpei, et autres
Publié: (2026)
par: Dong, Runpei, et autres
Publié: (2026)
Cost-Matching Model Predictive Control for Efficient Reinforcement Learning in Humanoid Locomotion
par: Cai, Wenqi, et autres
Publié: (2026)
par: Cai, Wenqi, et autres
Publié: (2026)
HALO: A Unified Vision-Language-Action Model for Embodied Multimodal Chain-of-Thought Reasoning
par: Shou, Quanxin, et autres
Publié: (2026)
par: Shou, Quanxin, et autres
Publié: (2026)
Laparoscopic Scene Analysis for Intraoperative Visualisation of Gamma Probe Signals in Minimally Invasive Cancer Surgery
par: Huang, Baoru
Publié: (2025)
par: Huang, Baoru
Publié: (2025)
GraspMAS: Zero-Shot Language-driven Grasp Detection with Multi-Agent System
par: Nguyen, Quang, et autres
Publié: (2025)
par: Nguyen, Quang, et autres
Publié: (2025)
LEGS: Fine-Tuning Teleop-Free VLAs for Humanoid Loco-manipulation in an Embodied Gaussian Splatting World
par: Kim, Hojune, et autres
Publié: (2026)
par: Kim, Hojune, et autres
Publié: (2026)
HumanoidMimicGen: Data Generation for Loco-Manipulation via Whole-Body Planning
par: Lin, Kevin, et autres
Publié: (2026)
par: Lin, Kevin, et autres
Publié: (2026)
Documents similaires
-
H2-COMPACT: Human-Humanoid Co-Manipulation via Adaptive Contact Trajectory Policies
par: Bethala, Geeta Chandra Raju, et autres
Publié: (2025) -
One-shot Adaptation of Humanoid Whole-body Motion with Walking Priors
par: Huang, Hao, et autres
Publié: (2025) -
Wavelet Policy: Lifting Scheme for Policy Learning in Long-Horizon Tasks
par: Huang, Hao, et autres
Publié: (2025) -
MapBERT: Bitwise Masked Modeling for Real-Time Semantic Mapping Generation
par: Deng, Yijie, et autres
Publié: (2025) -
How Secure Are Large Language Models (LLMs) for Navigation in Urban Environments?
par: Wen, Congcong, et autres
Publié: (2024)