TDMPBC: Self-Imitative Reinforcement Learning for Humanoid Robot Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhuang, Zifeng, Shi, Diyuan, Suo, Runze, He, Xiao, Zhang, Hongyin, Wang, Ting, Lyu, Shangke, Wang, Donglin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Discovering Self-Protective Falling Policy for Humanoid Robot via Deep Reinforcement Learning
di: Shi, Diyuan, et al.
Pubblicazione: (2025)
di: Shi, Diyuan, et al.
Pubblicazione: (2025)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
di: Xiao, Wei, et al.
Pubblicazione: (2025)
di: Xiao, Wei, et al.
Pubblicazione: (2025)
Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph
di: Zhang, Hongyin, et al.
Pubblicazione: (2023)
di: Zhang, Hongyin, et al.
Pubblicazione: (2023)
CMR: Contractive Mapping Embeddings for Robust Humanoid Locomotion on Unstructured Terrains
di: Zeng, Qixin, et al.
Pubblicazione: (2026)
di: Zeng, Qixin, et al.
Pubblicazione: (2026)
NFPO: Stabilized Policy Optimization of Normalizing Flow for Robotic Policy Learning
di: Shi, Diyuan, et al.
Pubblicazione: (2026)
di: Shi, Diyuan, et al.
Pubblicazione: (2026)
I-CTRL: Imitation to Control Humanoid Robots Through Constrained Reinforcement Learning
di: Yan, Yashuai, et al.
Pubblicazione: (2024)
di: Yan, Yashuai, et al.
Pubblicazione: (2024)
World-Value-Action Model: Implicit Planning for Vision-Language-Action Systems
di: Li, Runze, et al.
Pubblicazione: (2026)
di: Li, Runze, et al.
Pubblicazione: (2026)
ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning
di: Zhang, Hongyin, et al.
Pubblicazione: (2025)
di: Zhang, Hongyin, et al.
Pubblicazione: (2025)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
di: Su, Huikang, et al.
Pubblicazione: (2025)
di: Su, Huikang, et al.
Pubblicazione: (2025)
Dynamic Adaptive Legged Locomotion Policy via Decoupling Reaction Force Control and Gait Control
di: Wang, Renjie, et al.
Pubblicazione: (2025)
di: Wang, Renjie, et al.
Pubblicazione: (2025)
X2C: A Dataset Featuring Nuanced Facial Expressions for Realistic Humanoid Imitation
di: Li, Peizhen, et al.
Pubblicazione: (2025)
di: Li, Peizhen, et al.
Pubblicazione: (2025)
Bridging Scale Discrepancies in Robotic Control via Language-Based Action Representations
di: Zhang, Yuchi, et al.
Pubblicazione: (2025)
di: Zhang, Yuchi, et al.
Pubblicazione: (2025)
CRL-VLA: Continual Vision-Language-Action Learning
di: Zeng, Qixin, et al.
Pubblicazione: (2026)
di: Zeng, Qixin, et al.
Pubblicazione: (2026)
Multi-Gait Learning for Humanoid Robots Using Reinforcement Learning with Selective Adversarial Motion Prior
di: Wu, Yuanye, et al.
Pubblicazione: (2026)
di: Wu, Yuanye, et al.
Pubblicazione: (2026)
Integrating Trajectory Optimization and Reinforcement Learning for Quadrupedal Jumping with Terrain-Adaptive Landing
di: Wang, Renjie, et al.
Pubblicazione: (2025)
di: Wang, Renjie, et al.
Pubblicazione: (2025)
Learning Robotic Policy with Imagined Transition: Mitigating the Trade-off between Robustness and Optimality
di: Xiao, Wei, et al.
Pubblicazione: (2025)
di: Xiao, Wei, et al.
Pubblicazione: (2025)
KungfuBot2: Learning Versatile Motion Skills for Humanoid Whole-Body Control
di: Han, Jinrui, et al.
Pubblicazione: (2025)
di: Han, Jinrui, et al.
Pubblicazione: (2025)
VORL-EXPLORE: A Hybrid Learning Planning Approach to Multi-Robot Exploration in Dynamic Environments
di: Liu, Ning, et al.
Pubblicazione: (2026)
di: Liu, Ning, et al.
Pubblicazione: (2026)
Success in Humanoid Reinforcement Learning under Partial Observation
di: Wang, Wuhao, et al.
Pubblicazione: (2025)
di: Wang, Wuhao, et al.
Pubblicazione: (2025)
GEVRM: Goal-Expressive Video Generation Model For Robust Visual Manipulation
di: Zhang, Hongyin, et al.
Pubblicazione: (2025)
di: Zhang, Hongyin, et al.
Pubblicazione: (2025)
Humanoid-Gym: Reinforcement Learning for Humanoid Robot with Zero-Shot Sim2Real Transfer
di: Gu, Xinyang, et al.
Pubblicazione: (2024)
di: Gu, Xinyang, et al.
Pubblicazione: (2024)
RobotDancing: Residual-Action Reinforcement Learning Enables Robust Long-Horizon Humanoid Motion Tracking
di: Sun, Zhenguo, et al.
Pubblicazione: (2025)
di: Sun, Zhenguo, et al.
Pubblicazione: (2025)
VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning
di: Lu, Guanxing, et al.
Pubblicazione: (2025)
di: Lu, Guanxing, et al.
Pubblicazione: (2025)
Towards Biosignals-Free Autonomous Prosthetic Hand Control via Imitation Learning
di: Shi, Kaijie, et al.
Pubblicazione: (2025)
di: Shi, Kaijie, et al.
Pubblicazione: (2025)
Learning Multi-Modal Whole-Body Control for Real-World Humanoid Robots
di: Dugar, Pranay, et al.
Pubblicazione: (2024)
di: Dugar, Pranay, et al.
Pubblicazione: (2024)
RLIF: Interactive Imitation Learning as Reinforcement Learning
di: Luo, Jianlan, et al.
Pubblicazione: (2023)
di: Luo, Jianlan, et al.
Pubblicazione: (2023)
Reinforcement Learning Enabled Adaptive Multi-Task Control for Bipedal Soccer Robots
di: Zhang, Yulai, et al.
Pubblicazione: (2026)
di: Zhang, Yulai, et al.
Pubblicazione: (2026)
GBC: Generalized Behavior-Cloning Framework for Whole-Body Humanoid Imitation
di: Yao, Yifei, et al.
Pubblicazione: (2025)
di: Yao, Yifei, et al.
Pubblicazione: (2025)
IN-RIL: Interleaved Reinforcement and Imitation Learning for Policy Fine-Tuning
di: Gao, Dechen, et al.
Pubblicazione: (2025)
di: Gao, Dechen, et al.
Pubblicazione: (2025)
Towards Adaptable Humanoid Control via Adaptive Motion Tracking
di: Huang, Tao, et al.
Pubblicazione: (2025)
di: Huang, Tao, et al.
Pubblicazione: (2025)
TextOp: Real-time Interactive Text-Driven Humanoid Robot Motion Generation and Control
di: Xie, Weiji, et al.
Pubblicazione: (2026)
di: Xie, Weiji, et al.
Pubblicazione: (2026)
Self-Augmented Robot Trajectory: Efficient Imitation Learning via Safe Self-augmentation with Demonstrator-annotated Precision
di: Oh, Hanbit, et al.
Pubblicazione: (2025)
di: Oh, Hanbit, et al.
Pubblicazione: (2025)
Learning Humanoid Standing-up Control across Diverse Postures
di: Huang, Tao, et al.
Pubblicazione: (2025)
di: Huang, Tao, et al.
Pubblicazione: (2025)
Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation
di: Guo, Yihong, et al.
Pubblicazione: (2024)
di: Guo, Yihong, et al.
Pubblicazione: (2024)
Multi-Scenario Reasoning: Unlocking Cognitive Autonomy in Humanoid Robots for Multimodal Understanding
di: Wang, Libo
Pubblicazione: (2024)
di: Wang, Libo
Pubblicazione: (2024)
Humanoid World Models: Open World Foundation Models for Humanoid Robotics
di: Ali, Muhammad Qasim, et al.
Pubblicazione: (2025)
di: Ali, Muhammad Qasim, et al.
Pubblicazione: (2025)
Reward Training Wheels: Adaptive Auxiliary Rewards for Robotics Reinforcement Learning
di: Wang, Linji, et al.
Pubblicazione: (2025)
di: Wang, Linji, et al.
Pubblicazione: (2025)
Training Robots without Robots: Deep Imitation Learning for Master-to-Robot Policy Transfer
di: Kim, Heecheol, et al.
Pubblicazione: (2022)
di: Kim, Heecheol, et al.
Pubblicazione: (2022)
Scaling Tasks, Not Samples: Mastering Humanoid Control through Multi-Task Model-Based Reinforcement Learning
di: Liu, Shaohuai, et al.
Pubblicazione: (2026)
di: Liu, Shaohuai, et al.
Pubblicazione: (2026)
RILe: Reinforced Imitation Learning
di: Albaba, Mert, et al.
Pubblicazione: (2024)
di: Albaba, Mert, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Discovering Self-Protective Falling Policy for Humanoid Robot via Deep Reinforcement Learning
di: Shi, Diyuan, et al.
Pubblicazione: (2025) -
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
di: Xiao, Wei, et al.
Pubblicazione: (2025) -
Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph
di: Zhang, Hongyin, et al.
Pubblicazione: (2023) -
CMR: Contractive Mapping Embeddings for Robust Humanoid Locomotion on Unstructured Terrains
di: Zeng, Qixin, et al.
Pubblicazione: (2026) -
NFPO: Stabilized Policy Optimization of Normalizing Flow for Robotic Policy Learning
di: Shi, Diyuan, et al.
Pubblicazione: (2026)