Average-Reward Maximum Entropy Reinforcement Learning for Underactuated Double Pendulum Tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Choe, Jean Seong Bjorn, Choi, Bumkyu, Kim, Jong-kook |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Average-Reward Maximum Entropy Reinforcement Learning for Global Policy in Double Pendulum Tasks
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2025)
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2025)
Maximum Entropy On-Policy Actor-Critic via Entropy Advantage Estimation
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2024)
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2024)
Reward-Punishment Reinforcement Learning with Maximum Entropy
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
Decoupling Task and Behavior: A Two-Stage Reward Curriculum in Reinforcement Learning for Robotics
di: Freitag, Kilian, et al.
Pubblicazione: (2026)
di: Freitag, Kilian, et al.
Pubblicazione: (2026)
Curriculum Reinforcement Learning for Complex Reward Functions
di: Freitag, Kilian, et al.
Pubblicazione: (2024)
di: Freitag, Kilian, et al.
Pubblicazione: (2024)
On-Robot Reinforcement Learning with Goal-Contrastive Rewards
di: Biza, Ondrej, et al.
Pubblicazione: (2024)
di: Biza, Ondrej, et al.
Pubblicazione: (2024)
Robotic Skill Diversification via Active Mutation of Reward Functions in Reinforcement Learning During a Liquid Pouring Task
di: van Buuren, Jannick, et al.
Pubblicazione: (2025)
di: van Buuren, Jannick, et al.
Pubblicazione: (2025)
Reinforcement Learning for Robust Athletic Intelligence: Lessons from the 2nd 'AI Olympics with RealAIGym' Competition
di: Wiebe, Felix, et al.
Pubblicazione: (2025)
di: Wiebe, Felix, et al.
Pubblicazione: (2025)
Revisiting Sparse Rewards for Goal-Reaching Reinforcement Learning
di: Vasan, Gautham, et al.
Pubblicazione: (2024)
di: Vasan, Gautham, et al.
Pubblicazione: (2024)
Generalization in Deep Reinforcement Learning for Robotic Navigation by Reward Shaping
di: Miranda, Victor R. F., et al.
Pubblicazione: (2022)
di: Miranda, Victor R. F., et al.
Pubblicazione: (2022)
Trajectory Entropy Reinforcement Learning for Predictable and Robust Control
di: You, Bang, et al.
Pubblicazione: (2025)
di: You, Bang, et al.
Pubblicazione: (2025)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
Multi-Task Reinforcement Learning for Quadrotors
di: Xing, Jiaxu, et al.
Pubblicazione: (2024)
di: Xing, Jiaxu, et al.
Pubblicazione: (2024)
Low-cost Real-world Implementation of the Swing-up Pendulum for Deep Reinforcement Learning Experiments
di: Böhm, Peter, et al.
Pubblicazione: (2025)
di: Böhm, Peter, et al.
Pubblicazione: (2025)
Real-Time Model Predictive Control for the Swing-Up Problem of an Underactuated Double Pendulum
di: Burchard, Blanka, et al.
Pubblicazione: (2025)
di: Burchard, Blanka, et al.
Pubblicazione: (2025)
The Bid Picture: Auction-Inspired Multi-player Generative Adversarial Networks Training
di: Shim, Joo Yong, et al.
Pubblicazione: (2024)
di: Shim, Joo Yong, et al.
Pubblicazione: (2024)
FedEMA: Federated Exponential Moving Averaging with Negative Entropy Regularizer in Autonomous Driving
di: Kou, Wei-Bin, et al.
Pubblicazione: (2025)
di: Kou, Wei-Bin, et al.
Pubblicazione: (2025)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
di: Venugopal, Aravind, et al.
Pubblicazione: (2026)
di: Venugopal, Aravind, et al.
Pubblicazione: (2026)
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023)
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023)
ProgVLA: Progress-Aware Robot Manipulation Skill Learning
di: Kim, Seungsu, et al.
Pubblicazione: (2026)
di: Kim, Seungsu, et al.
Pubblicazione: (2026)
Subwords as Skills: Tokenization for Sparse-Reward Reinforcement Learning
di: Yunis, David, et al.
Pubblicazione: (2023)
di: Yunis, David, et al.
Pubblicazione: (2023)
Residual Reward Models for Preference-based Reinforcement Learning
di: Cao, Chenyang, et al.
Pubblicazione: (2025)
di: Cao, Chenyang, et al.
Pubblicazione: (2025)
DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
BiCQL-ML: A Bi-Level Conservative Q-Learning Framework for Maximum Likelihood Inverse Reinforcement Learning
di: Park, Junsung
Pubblicazione: (2025)
di: Park, Junsung
Pubblicazione: (2025)
DrS: Learning Reusable Dense Rewards for Multi-Stage Tasks
di: Mu, Tongzhou, et al.
Pubblicazione: (2024)
di: Mu, Tongzhou, et al.
Pubblicazione: (2024)
Deep Reinforcement Learning for Haptic Shared Control in Unknown Tasks
di: Fernandez, Franklin Cardeñoso, et al.
Pubblicazione: (2021)
di: Fernandez, Franklin Cardeñoso, et al.
Pubblicazione: (2021)
Communication-Aware Reinforcement Learning for Cooperative Adaptive Cruise Control
di: Jiang, Sicong, et al.
Pubblicazione: (2024)
di: Jiang, Sicong, et al.
Pubblicazione: (2024)
STRIDE: Automating Reward Design, Deep Reinforcement Learning Training and Feedback Optimization in Humanoid Robotics Locomotion
di: Wu, Zhenwei, et al.
Pubblicazione: (2025)
di: Wu, Zhenwei, et al.
Pubblicazione: (2025)
MoRe-ERL: Learning Motion Residuals using Episodic Reinforcement Learning
di: Huang, Xi, et al.
Pubblicazione: (2025)
di: Huang, Xi, et al.
Pubblicazione: (2025)
Learning Emergent Gaits with Decentralized Phase Oscillators: on the role of Observations, Rewards, and Feedback
di: Zhang, Jenny, et al.
Pubblicazione: (2024)
di: Zhang, Jenny, et al.
Pubblicazione: (2024)
Projected Task-Specific Layers for Multi-Task Reinforcement Learning
di: Roberts, Josselin Somerville, et al.
Pubblicazione: (2023)
di: Roberts, Josselin Somerville, et al.
Pubblicazione: (2023)
Offline Reinforcement Learning using Human-Aligned Reward Labeling for Autonomous Emergency Braking in Occluded Pedestrian Crossing
di: Asodia, Vinal, et al.
Pubblicazione: (2025)
di: Asodia, Vinal, et al.
Pubblicazione: (2025)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
MENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement Learning
di: Huang, Suning, et al.
Pubblicazione: (2024)
di: Huang, Suning, et al.
Pubblicazione: (2024)
A Review of Reward Functions for Reinforcement Learning in the context of Autonomous Driving
di: Abouelazm, Ahmed, et al.
Pubblicazione: (2024)
di: Abouelazm, Ahmed, et al.
Pubblicazione: (2024)
Beware Untrusted Simulators -- Reward-Free Backdoor Attacks in Reinforcement Learning
di: Rathbun, Ethan, et al.
Pubblicazione: (2026)
di: Rathbun, Ethan, et al.
Pubblicazione: (2026)
Partially Equivariant Reinforcement Learning in Symmetry-Breaking Environments
di: Chang, Junwoo, et al.
Pubblicazione: (2025)
di: Chang, Junwoo, et al.
Pubblicazione: (2025)
TD-MPC-Opt: Distilling Model-Based Multi-Task Reinforcement Learning Agents
di: Kuzmenko, Dmytro, et al.
Pubblicazione: (2025)
di: Kuzmenko, Dmytro, et al.
Pubblicazione: (2025)
Solving Robotics Tasks with Prior Demonstration via Exploration-Efficient Deep Reinforcement Learning
di: Shen, Chengyandan, et al.
Pubblicazione: (2025)
di: Shen, Chengyandan, et al.
Pubblicazione: (2025)
Bresa: Bio-inspired Reflexive Safe Reinforcement Learning for Contact-Rich Robotic Tasks
di: Zhang, Heng, et al.
Pubblicazione: (2025)
di: Zhang, Heng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Average-Reward Maximum Entropy Reinforcement Learning for Global Policy in Double Pendulum Tasks
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2025) -
Maximum Entropy On-Policy Actor-Critic via Entropy Advantage Estimation
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2024) -
Reward-Punishment Reinforcement Learning with Maximum Entropy
di: Wang, Jiexin, et al.
Pubblicazione: (2024) -
Decoupling Task and Behavior: A Two-Stage Reward Curriculum in Reinforcement Learning for Robotics
di: Freitag, Kilian, et al.
Pubblicazione: (2026) -
Curriculum Reinforcement Learning for Complex Reward Functions
di: Freitag, Kilian, et al.
Pubblicazione: (2024)