Learning to Get Up Across Morphologies: Zero-Shot Recovery with a Unified Humanoid Policy
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Spraggett, Jonathan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ZAPS-DA: Zero-Phase Action Policy Smoothing with Decoupled Actor for Continuous Control in Reinforcement Learning
par: Shamass, Faiq
Publié: (2026)
par: Shamass, Faiq
Publié: (2026)
Pure Planning to Pure Policies and In Between with a Recursive Tree Planner
par: Redlich, A. Norman
Publié: (2024)
par: Redlich, A. Norman
Publié: (2024)
Positive-Only Drifting Policy Optimization
par: Zhang, Qi
Publié: (2026)
par: Zhang, Qi
Publié: (2026)
Bringing the RT-1-X Foundation Model to a SCARA robot
par: Salzer, Jonathan, et autres
Publié: (2024)
par: Salzer, Jonathan, et autres
Publié: (2024)
Physics-Informed Policy Optimization via Analytic Dynamics Regularization
par: Chandra, Namai, et autres
Publié: (2026)
par: Chandra, Namai, et autres
Publié: (2026)
End-to-End Imitation Learning for Optimal Asteroid Proximity Operations
par: Quinn, Patrick, et autres
Publié: (2025)
par: Quinn, Patrick, et autres
Publié: (2025)
A Scalable Decentralized Reinforcement Learning Framework for UAV Target Localization Using Recurrent PPO
par: Fernando, Leon, et autres
Publié: (2024)
par: Fernando, Leon, et autres
Publié: (2024)
Opinion: Towards Unified Expressive Policy Optimization for Robust Robot Learning
par: Huang, Haidong, et autres
Publié: (2025)
par: Huang, Haidong, et autres
Publié: (2025)
Knowledge Transfer in Model-Based Reinforcement Learning Agents for Efficient Multi-Task Learning
par: Kuzmenko, Dmytro, et autres
Publié: (2025)
par: Kuzmenko, Dmytro, et autres
Publié: (2025)
A Generative System for Robot-to-Human Handovers: from Intent Inference to Spatial Configuration Imagery
par: Zhang, Hanxin, et autres
Publié: (2025)
par: Zhang, Hanxin, et autres
Publié: (2025)
DiffSim2Real: Deploying Quadrupedal Locomotion Policies Purely Trained in Differentiable Simulation
par: Bagajo, Joshua, et autres
Publié: (2024)
par: Bagajo, Joshua, et autres
Publié: (2024)
Real-Time Synchronized Interaction Framework for Emotion-Aware Humanoid Robots
par: Chen, Yanrong, et autres
Publié: (2026)
par: Chen, Yanrong, et autres
Publié: (2026)
Exploiting Policy Idling for Dexterous Manipulation
par: Chen, Annie S., et autres
Publié: (2025)
par: Chen, Annie S., et autres
Publié: (2025)
GET-Zero: Graph Embodiment Transformer for Zero-shot Embodiment Generalization
par: Patel, Austin, et autres
Publié: (2024)
par: Patel, Austin, et autres
Publié: (2024)
LANGTRAJ: Diffusion Model and Dataset for Language-Conditioned Trajectory Simulation
par: Chang, Wei-Jer, et autres
Publié: (2025)
par: Chang, Wei-Jer, et autres
Publié: (2025)
How VLAs Fail Differently: Black-Box Action Monitoring Reveals Architecture-Specific Failure Signatures
par: Gupta, Krishnam
Publié: (2026)
par: Gupta, Krishnam
Publié: (2026)
Tactile-Proprioceptive Sensor Fusion for Contact Wrench Estimation in Whole-Body Physical Human-Robot Interaction
par: Min, Junha, et autres
Publié: (2026)
par: Min, Junha, et autres
Publié: (2026)
Real-Time Whole-Body Teleoperation of a Humanoid Robot Using IMU-Based Motion Capture with Sim2Sim and Sim2Real Validation
par: Durrani, Hamza Ahmed, et autres
Publié: (2026)
par: Durrani, Hamza Ahmed, et autres
Publié: (2026)
Learning Agile Gate Traversal via Analytical Optimal Policy Gradient
par: Sun, Tianchen, et autres
Publié: (2025)
par: Sun, Tianchen, et autres
Publié: (2025)
World-VLA-Loop: Closed-Loop Learning of Video World Model and VLA Policy
par: Liu, Xiaokang, et autres
Publié: (2026)
par: Liu, Xiaokang, et autres
Publié: (2026)
Benchmarking Deep Reinforcement Learning for Navigation in Denied Sensor Environments
par: Wisniewski, Mariusz, et autres
Publié: (2024)
par: Wisniewski, Mariusz, et autres
Publié: (2024)
Machine Learning Based Path Planning for Improved Rover Navigation (Pre-Print Version)
par: Abcouwer, Neil, et autres
Publié: (2020)
par: Abcouwer, Neil, et autres
Publié: (2020)
CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
par: Römer, Ralf, et autres
Publié: (2026)
par: Römer, Ralf, et autres
Publié: (2026)
HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos
par: Wang, Zhi, et autres
Publié: (2026)
par: Wang, Zhi, et autres
Publié: (2026)
Lie Theory Based Optimization for Unified State Planning of Mobile Manipulators
par: Smith, William, et autres
Publié: (2024)
par: Smith, William, et autres
Publié: (2024)
Towards a Robust Soft Baby Robot With Rich Interaction Ability for Advanced Machine Learning Algorithms
par: Alhakami, Mohannad, et autres
Publié: (2024)
par: Alhakami, Mohannad, et autres
Publié: (2024)
Behavior Imitation for Manipulator Control and Grasping with Deep Reinforcement Learning
par: Qiyuan, Liu
Publié: (2024)
par: Qiyuan, Liu
Publié: (2024)
MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
par: Li, Xidong, et autres
Publié: (2026)
par: Li, Xidong, et autres
Publié: (2026)
Long-Horizon Visual Imitation Learning via Plan and Code Reflection
par: Chen, Quan, et autres
Publié: (2025)
par: Chen, Quan, et autres
Publié: (2025)
Reinforcement Learning-Based Energy-Aware Coverage Path Planning for Precision Agriculture
par: Wu, Beining, et autres
Publié: (2026)
par: Wu, Beining, et autres
Publié: (2026)
Learning from Watching: Scalable Extraction of Manipulation Trajectories from Human Videos
par: Hu, X., et autres
Publié: (2025)
par: Hu, X., et autres
Publié: (2025)
UMI on Legs: Making Manipulation Policies Mobile with Manipulation-Centric Whole-body Controllers
par: Ha, Huy, et autres
Publié: (2024)
par: Ha, Huy, et autres
Publié: (2024)
Enhancing Reinforcement Learning in 3D Environments through Semantic Segmentation: A Case Study in ViZDoom
par: Huang, Jin
Publié: (2025)
par: Huang, Jin
Publié: (2025)
Video2Act: A Dual-System Video Diffusion Policy with Robotic Spatio-Motional Modeling
par: Jia, Yueru, et autres
Publié: (2025)
par: Jia, Yueru, et autres
Publié: (2025)
Generalizable Collaborative Search-and-Capture in Cluttered Environments via Path-Guided MAPPO and Directional Frontier Allocation
par: Ying, Jialin, et autres
Publié: (2025)
par: Ying, Jialin, et autres
Publié: (2025)
GRoQ-LoCO: Generalist and Robot-agnostic Quadruped Locomotion Control using Offline Datasets
par: PP, Narayanan, et autres
Publié: (2025)
par: PP, Narayanan, et autres
Publié: (2025)
Hierarchical Object-Oriented POMDP Planning for Object Rearrangement
par: Mangannavar, Rajesh, et autres
Publié: (2024)
par: Mangannavar, Rajesh, et autres
Publié: (2024)
Deep Dynamics: Vehicle Dynamics Modeling with a Physics-Constrained Neural Network for Autonomous Racing
par: Chrosniak, John, et autres
Publié: (2023)
par: Chrosniak, John, et autres
Publié: (2023)
Sim-to-Real Transfer via a Style-Identified Cycle Consistent Generative Adversarial Network: Zero-Shot Deployment on Robotic Manipulators through Visual Domain Adaptation
par: Güitta-López, Lucía, et autres
Publié: (2026)
par: Güitta-López, Lucía, et autres
Publié: (2026)
Newtonian and Lagrangian Neural Networks: A Comparison Towards Efficient Inverse Dynamics Identification
par: Trinh, Minh, et autres
Publié: (2025)
par: Trinh, Minh, et autres
Publié: (2025)
Documents similaires
-
ZAPS-DA: Zero-Phase Action Policy Smoothing with Decoupled Actor for Continuous Control in Reinforcement Learning
par: Shamass, Faiq
Publié: (2026) -
Pure Planning to Pure Policies and In Between with a Recursive Tree Planner
par: Redlich, A. Norman
Publié: (2024) -
Positive-Only Drifting Policy Optimization
par: Zhang, Qi
Publié: (2026) -
Bringing the RT-1-X Foundation Model to a SCARA robot
par: Salzer, Jonathan, et autres
Publié: (2024) -
Physics-Informed Policy Optimization via Analytic Dynamics Regularization
par: Chandra, Namai, et autres
Publié: (2026)