Learning Emergent Gaits with Decentralized Phase Oscillators: on the role of Observations, Rewards, and Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Jenny, Heim, Steve, Jeon, Se Hwan, Kim, Sangbae |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FLD: Fourier Latent Dynamics for Structured Motion Representation and Learning
par: Li, Chenhao, et autres
Publié: (2024)
par: Li, Chenhao, et autres
Publié: (2024)
Learning Humanoid Arm Motion via Centroidal Momentum Regularized Multi-Agent Reinforcement Learning
par: Lee, Ho Jae, et autres
Publié: (2025)
par: Lee, Ho Jae, et autres
Publié: (2025)
Residual MPC: Blending Reinforcement Learning with GPU-Parallelized Model Predictive Control
par: Jeon, Se Hwan, et autres
Publié: (2025)
par: Jeon, Se Hwan, et autres
Publié: (2025)
CusADi: A GPU Parallelization Framework for Symbolic Expressions and Optimal Control
par: Jeon, Se Hwan, et autres
Publié: (2024)
par: Jeon, Se Hwan, et autres
Publié: (2024)
Policy Learning from Large Vision-Language Model Feedback without Reward Modeling
par: Luu, Tung M., et autres
Publié: (2025)
par: Luu, Tung M., et autres
Publié: (2025)
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback
par: Chakraborty, Souradip, et autres
Publié: (2023)
par: Chakraborty, Souradip, et autres
Publié: (2023)
Adaptive Querying for Reward Learning from Human Feedback
par: Anand, Yashwanthi, et autres
Publié: (2024)
par: Anand, Yashwanthi, et autres
Publié: (2024)
Learning Reactive Dexterous Grasping via Hierarchical Task-Space RL Planning and Joint-Space QP Control
par: Lee, Ho Jae, et autres
Publié: (2026)
par: Lee, Ho Jae, et autres
Publié: (2026)
STRIDE: Automating Reward Design, Deep Reinforcement Learning Training and Feedback Optimization in Humanoid Robotics Locomotion
par: Wu, Zhenwei, et autres
Publié: (2025)
par: Wu, Zhenwei, et autres
Publié: (2025)
Causally Robust Reward Learning from Reason-Augmented Preference Feedback
par: Hwang, Minjune, et autres
Publié: (2026)
par: Hwang, Minjune, et autres
Publié: (2026)
Gait in Eight: Efficient On-Robot Learning for Omnidirectional Quadruped Locomotion
par: Bohlinger, Nico, et autres
Publié: (2025)
par: Bohlinger, Nico, et autres
Publié: (2025)
Safe Value Functions
par: Massiani, Pierre-François, et autres
Publié: (2021)
par: Massiani, Pierre-François, et autres
Publié: (2021)
Average-Reward Maximum Entropy Reinforcement Learning for Underactuated Double Pendulum Tasks
par: Choe, Jean Seong Bjorn, et autres
Publié: (2024)
par: Choe, Jean Seong Bjorn, et autres
Publié: (2024)
Gaitor: Learning a Unified Representation Across Gaits for Real-World Quadruped Locomotion
par: Mitchell, Alexander L., et autres
Publié: (2024)
par: Mitchell, Alexander L., et autres
Publié: (2024)
Learn to Swim: Data-Driven LSTM Hydrodynamic Model for Quadruped Robot Gait Optimization
par: Han, Fei, et autres
Publié: (2025)
par: Han, Fei, et autres
Publié: (2025)
ProcVLM: Learning Procedure-Grounded Progress Rewards for Robotic Manipulation
par: Feng, Youhe, et autres
Publié: (2026)
par: Feng, Youhe, et autres
Publié: (2026)
CoordLight: Learning Decentralized Coordination for Network-Wide Traffic Signal Control
par: Zhang, Yifeng, et autres
Publié: (2026)
par: Zhang, Yifeng, et autres
Publié: (2026)
Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models
par: Luu, Tung Minh, et autres
Publié: (2025)
par: Luu, Tung Minh, et autres
Publié: (2025)
Curriculum Reinforcement Learning for Complex Reward Functions
par: Freitag, Kilian, et autres
Publié: (2024)
par: Freitag, Kilian, et autres
Publié: (2024)
On-Robot Reinforcement Learning with Goal-Contrastive Rewards
par: Biza, Ondrej, et autres
Publié: (2024)
par: Biza, Ondrej, et autres
Publié: (2024)
Revisiting Sparse Rewards for Goal-Reaching Reinforcement Learning
par: Vasan, Gautham, et autres
Publié: (2024)
par: Vasan, Gautham, et autres
Publié: (2024)
Probabilistic Safety Guarantee for Stochastic Control Systems Using Average Reward MDPs
par: Omidi, Saber, et autres
Publié: (2025)
par: Omidi, Saber, et autres
Publié: (2025)
Generalization in Deep Reinforcement Learning for Robotic Navigation by Reward Shaping
par: Miranda, Victor R. F., et autres
Publié: (2022)
par: Miranda, Victor R. F., et autres
Publié: (2022)
Rewarding DINO: Predicting Dense Rewards with Vision Foundation Models
par: Krack, Pierre, et autres
Publié: (2026)
par: Krack, Pierre, et autres
Publié: (2026)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
par: Ishihara, Yu, et autres
Publié: (2025)
par: Ishihara, Yu, et autres
Publié: (2025)
The Dark Side of Rich Rewards: Understanding and Mitigating Noise in VLM Rewards
par: Huang, Sukai, et autres
Publié: (2024)
par: Huang, Sukai, et autres
Publié: (2024)
ReLAM: Learning Anticipation Model for Rewarding Visual Robotic Manipulation
par: Tang, Nan, et autres
Publié: (2025)
par: Tang, Nan, et autres
Publié: (2025)
SCDP: Learning Humanoid Locomotion from Partial Observations via Mixed-Observation Distillation
par: Carroll, Milo, et autres
Publié: (2026)
par: Carroll, Milo, et autres
Publié: (2026)
Evidence of an Emergent "Self" in Continual Robot Learning
par: Jhunjhunwala, Adidev, et autres
Publié: (2026)
par: Jhunjhunwala, Adidev, et autres
Publié: (2026)
Online Intrinsic Rewards for Decision Making Agents from Large Language Model Feedback
par: Zheng, Qinqing, et autres
Publié: (2024)
par: Zheng, Qinqing, et autres
Publié: (2024)
Robot Policy Learning with Temporal Optimal Transport Reward
par: Fu, Yuwei, et autres
Publié: (2024)
par: Fu, Yuwei, et autres
Publié: (2024)
Improving Generalization Ability of Robotic Imitation Learning by Resolving Causal Confusion in Observations
par: Chen, Yifei, et autres
Publié: (2025)
par: Chen, Yifei, et autres
Publié: (2025)
ELEMENTAL: Interactive Learning from Demonstrations and Vision-Language Models for Reward Design in Robotics
par: Chen, Letian, et autres
Publié: (2024)
par: Chen, Letian, et autres
Publié: (2024)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
par: Venugopal, Aravind, et autres
Publié: (2026)
par: Venugopal, Aravind, et autres
Publié: (2026)
Decoupling Task and Behavior: A Two-Stage Reward Curriculum in Reinforcement Learning for Robotics
par: Freitag, Kilian, et autres
Publié: (2026)
par: Freitag, Kilian, et autres
Publié: (2026)
Diffusion-Reward Adversarial Imitation Learning
par: Lai, Chun-Mao, et autres
Publié: (2024)
par: Lai, Chun-Mao, et autres
Publié: (2024)
Teaching Robots to Handle Nuclear Waste: A Teleoperation-Based Learning Approach<
par: Lee, Joong-Ku, et autres
Publié: (2025)
par: Lee, Joong-Ku, et autres
Publié: (2025)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
Intentionally-underestimated Value Function at Terminal State for Temporal-difference Learning with Mis-designed Reward
par: Kobayashi, Taisuke
Publié: (2023)
par: Kobayashi, Taisuke
Publié: (2023)
Decentralized Gaussian Process Classification and an Application in Subsea Robotics
par: Gao, Yifei, et autres
Publié: (2025)
par: Gao, Yifei, et autres
Publié: (2025)
Documents similaires
-
FLD: Fourier Latent Dynamics for Structured Motion Representation and Learning
par: Li, Chenhao, et autres
Publié: (2024) -
Learning Humanoid Arm Motion via Centroidal Momentum Regularized Multi-Agent Reinforcement Learning
par: Lee, Ho Jae, et autres
Publié: (2025) -
Residual MPC: Blending Reinforcement Learning with GPU-Parallelized Model Predictive Control
par: Jeon, Se Hwan, et autres
Publié: (2025) -
CusADi: A GPU Parallelization Framework for Symbolic Expressions and Optimal Control
par: Jeon, Se Hwan, et autres
Publié: (2024) -
Policy Learning from Large Vision-Language Model Feedback without Reward Modeling
par: Luu, Tung M., et autres
Publié: (2025)