SCDP: Learning Humanoid Locomotion from Partial Observations via Mixed-Observation Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Carroll, Milo, Peng, Tianhu, Bao, Lingfan, Zhou, Chengxu, Li, Zhibin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Gait-Conditioned Reinforcement Learning with Multi-Phase Curriculum for Humanoid Locomotion
par: Peng, Tianhu, et autres
Publié: (2025)
par: Peng, Tianhu, et autres
Publié: (2025)
Sim-to-Real Transfer in Deep Reinforcement Learning for Bipedal Locomotion
par: Bao, Lingfan, et autres
Publié: (2025)
par: Bao, Lingfan, et autres
Publié: (2025)
Deep Reinforcement Learning for Bipedal Locomotion: A Brief Survey
par: Bao, Lingfan, et autres
Publié: (2024)
par: Bao, Lingfan, et autres
Publié: (2024)
Hierarchical Intention-Aware Expressive Motion Generation for Humanoid Robots
par: Bao, Lingfan, et autres
Publié: (2025)
par: Bao, Lingfan, et autres
Publié: (2025)
A High-Fidelity Digital Twin for Robotic Manipulation Based on 3D Gaussian Splatting
par: Sun, Ziyang, et autres
Publié: (2026)
par: Sun, Ziyang, et autres
Publié: (2026)
Learning Bipedal Walking on a Quadruped Robot via Adversarial Motion Priors
par: Peng, Tianhu, et autres
Publié: (2024)
par: Peng, Tianhu, et autres
Publié: (2024)
Distilling Reinforcement Learning Policies for Interpretable Robot Locomotion: Gradient Boosting Machines and Symbolic Regression
par: Acero, Fernando, et autres
Publié: (2024)
par: Acero, Fernando, et autres
Publié: (2024)
Learning Humanoid Locomotion over Challenging Terrain
par: Radosavovic, Ilija, et autres
Publié: (2024)
par: Radosavovic, Ilija, et autres
Publié: (2024)
Learning Humanoid Locomotion with World Model Reconstruction
par: Sun, Wandong, et autres
Publié: (2025)
par: Sun, Wandong, et autres
Publié: (2025)
Humanoid Whole-Body Locomotion on Narrow Terrain via Dynamic Balance and Reinforcement Learning
par: Xie, Weiji, et autres
Publié: (2025)
par: Xie, Weiji, et autres
Publié: (2025)
Exciting Action: Investigating Efficient Exploration for Learning Musculoskeletal Humanoid Locomotion
par: Geiß, Henri-Jacques, et autres
Publié: (2024)
par: Geiß, Henri-Jacques, et autres
Publié: (2024)
Learning Sim-to-Real Humanoid Locomotion in 15 Minutes
par: Seo, Younggyo, et autres
Publié: (2025)
par: Seo, Younggyo, et autres
Publié: (2025)
Natural Humanoid Robot Locomotion with Generative Motion Prior
par: Zhang, Haodong, et autres
Publié: (2025)
par: Zhang, Haodong, et autres
Publié: (2025)
Learn to Teach: Sample-Efficient Privileged Learning for Humanoid Locomotion over Diverse Terrains
par: Wu, Feiyang, et autres
Publié: (2024)
par: Wu, Feiyang, et autres
Publié: (2024)
Egocentric Tactile and Proximity Sensors as Observation Priors for Humanoid Collision Avoidance
par: Kohlbrenner, Carson, et autres
Publié: (2026)
par: Kohlbrenner, Carson, et autres
Publié: (2026)
HumanoidBench: Simulated Humanoid Benchmark for Whole-Body Locomotion and Manipulation
par: Sferrazza, Carmelo, et autres
Publié: (2024)
par: Sferrazza, Carmelo, et autres
Publié: (2024)
Spectral Normalization for Lipschitz-Constrained Policies on Learning Humanoid Locomotion
par: Shin, Jaeyong, et autres
Publié: (2025)
par: Shin, Jaeyong, et autres
Publié: (2025)
BeamDojo: Learning Agile Humanoid Locomotion on Sparse Footholds
par: Wang, Huayi, et autres
Publié: (2025)
par: Wang, Huayi, et autres
Publié: (2025)
FLAM: Foundation Model-Based Body Stabilization for Humanoid Locomotion and Manipulation
par: Zhang, Xianqi, et autres
Publié: (2025)
par: Zhang, Xianqi, et autres
Publié: (2025)
STRIDE: Automating Reward Design, Deep Reinforcement Learning Training and Feedback Optimization in Humanoid Robotics Locomotion
par: Wu, Zhenwei, et autres
Publié: (2025)
par: Wu, Zhenwei, et autres
Publié: (2025)
DreamPolicy: A Unified World-model Policy for Scalable Humanoid Locomotion
par: Fan, Yahao, et autres
Publié: (2025)
par: Fan, Yahao, et autres
Publié: (2025)
HoRD: Robust Humanoid Control via History-Conditioned Reinforcement Learning and Online Distillation
par: Wang, Puyue, et autres
Publié: (2026)
par: Wang, Puyue, et autres
Publié: (2026)
Humanoid Locomotion as Next Token Prediction
par: Radosavovic, Ilija, et autres
Publié: (2024)
par: Radosavovic, Ilija, et autres
Publié: (2024)
Goal-Reaching Policy Learning from Non-Expert Observations via Effective Subgoal Guidance
par: Huang, RenMing, et autres
Publié: (2024)
par: Huang, RenMing, et autres
Publié: (2024)
A Hybrid Autoencoder for Robust Heightmap Generation from Fused Lidar and Depth Data for Humanoid Robot Locomotion
par: Bank, Dennis, et autres
Publié: (2026)
par: Bank, Dennis, et autres
Publié: (2026)
Quadruped Parkour Learning: Sparsely Gated Mixture of Experts with Visual Input
par: Ziegltrum, Michael, et autres
Publié: (2026)
par: Ziegltrum, Michael, et autres
Publié: (2026)
Observation Adaptation via Annealed Importance Resampling for Partially Observable Markov Decision Processes
par: Zhang, Yunuo, et autres
Publié: (2025)
par: Zhang, Yunuo, et autres
Publié: (2025)
Symmetry-Guided Memory Augmentation for Efficient Locomotion Learning
par: Bao, Kaixi, et autres
Publié: (2025)
par: Bao, Kaixi, et autres
Publié: (2025)
Viewpoint-Agnostic Grasp Pipeline using VLM and Partial Observations
par: Almeida, Dilermando, et autres
Publié: (2026)
par: Almeida, Dilermando, et autres
Publié: (2026)
Embodiment-Aware Generalist Specialist Distillation for Unified Humanoid Whole-Body Control
par: Peng, Quanquan, et autres
Publié: (2026)
par: Peng, Quanquan, et autres
Publié: (2026)
Success in Humanoid Reinforcement Learning under Partial Observation
par: Wang, Wuhao, et autres
Publié: (2025)
par: Wang, Wuhao, et autres
Publié: (2025)
Learning to Adapt through Bio-Inspired Gait Strategies for Versatile Quadruped Locomotion
par: Humphreys, Joseph, et autres
Publié: (2024)
par: Humphreys, Joseph, et autres
Publié: (2024)
Cost Function Estimation Using Inverse Reinforcement Learning with Minimal Observations
par: Mehrdad, Sarmad, et autres
Publié: (2025)
par: Mehrdad, Sarmad, et autres
Publié: (2025)
Learning Aerodynamics for the Control of Flying Humanoid Robots
par: Paolino, Antonello, et autres
Publié: (2025)
par: Paolino, Antonello, et autres
Publié: (2025)
Learning from Observation: A Survey of Recent Advances
par: Burnwal, Returaj, et autres
Publié: (2025)
par: Burnwal, Returaj, et autres
Publié: (2025)
Imitation Learning from Observation through Optimal Transport
par: Chang, Wei-Di, et autres
Publié: (2023)
par: Chang, Wei-Di, et autres
Publié: (2023)
Imitation Learning from Observation with Automatic Discount Scheduling
par: Liu, Yuyang, et autres
Publié: (2023)
par: Liu, Yuyang, et autres
Publié: (2023)
Architecture Is All You Need: Diversity-Enabled Sweet Spots for Robust Humanoid Locomotion
par: Werner, Blake, et autres
Publié: (2025)
par: Werner, Blake, et autres
Publié: (2025)
E-SDS: Environment-aware See it, Do it, Sorted - Automated Environment-Aware Reinforcement Learning for Humanoid Locomotion
par: Yalcin, Enis, et autres
Publié: (2025)
par: Yalcin, Enis, et autres
Publié: (2025)
CaT: Constraints as Terminations for Legged Locomotion Reinforcement Learning
par: Chane-Sane, Elliot, et autres
Publié: (2024)
par: Chane-Sane, Elliot, et autres
Publié: (2024)
Documents similaires
-
Gait-Conditioned Reinforcement Learning with Multi-Phase Curriculum for Humanoid Locomotion
par: Peng, Tianhu, et autres
Publié: (2025) -
Sim-to-Real Transfer in Deep Reinforcement Learning for Bipedal Locomotion
par: Bao, Lingfan, et autres
Publié: (2025) -
Deep Reinforcement Learning for Bipedal Locomotion: A Brief Survey
par: Bao, Lingfan, et autres
Publié: (2024) -
Hierarchical Intention-Aware Expressive Motion Generation for Humanoid Robots
par: Bao, Lingfan, et autres
Publié: (2025) -
A High-Fidelity Digital Twin for Robotic Manipulation Based on 3D Gaussian Splatting
par: Sun, Ziyang, et autres
Publié: (2026)